reklama

Malá exkurze do nitra architektury K10

Nových Opteronů, prvních procesorů AMD s architekturou K10, známých jako Barcelona, se dočkáme už 10. září.

Nová architektura AMD K10 je pokračováním předchozí 64bitové architektury s integrovaným paměťovým řadičem AMD K8, kterou známe z procesorů Athlon 64 a Sempron. Dlouho očekávané nové jádro pro serverové procesory Opteron je známé pod kódovým označením Barcelona, pro stolní počítače přijde jádro Phenom. Následovat bude ještě řada dalších jader postavených na architektuře K10.

Podíváme se na některé zajímavé změny, které s sebou nová architektura přináší.

Klepněte pro větší obrázek

Klepněte pro větší obrázek

Šířka instrukční L1 cache se od architektury K8 zdvojnásobila na 256bitů (32B). Technologie Wide floating-point accelerator ve zkratce znamená oproti architektuře K8 dvojnásobnou, tedy 128bitovou šířku datových cest pro výpočty s plovoucí desetinnou čárkou, takže delší 128bitové instrukce již není nutné dělit na dvě 64bitové operace, jako tomu bylo v případě K8. Přibyly i 128 bitové SEE instrukce a instrukční soubor. Vylepšeno je i předpovídání větvení (branch prediction), díky čemu by měly programy napsané ve vysokoúrovňovém objektově orientovaném kódu běžet mnohem rychleji. Pokud vás zajímá, co všechno se změnilo z programátorského hlediska, doporučujeme prostudovat anglický článek zveřejněný na serveru X-bit Laboratories, kde tuto problematiku probírají podrobněji.

Každé jádro má mít vlastní L2 cache o velikosti 512 kB (u pozdějších modelů i 1 024 kB). Oproti sdílené L2 cache to má své výhody i nevýhody. Výhodou je, že se vytížená jádra procesorů nemusí o cache přetahovat a nedochází ke konfiktům, jako v případě Core 2 Duo, nevýhodou ale je, že v případě, že některé z jader L2 cache nevyužívá, nemůže ji přenechat k dispozici těm ostatním.

Oproti předcházejícím generacím procesorů navíc přibyla sdílená L3 cache o velikosti 2 MB, která může být dále zvětšena. Například pro 45nm výrobní proces už se uvažuje o velikosti až 6 MB. Vyrovnávací paměť třetí úrovně slouží ke sdílení dat mezi jednotlivými jádry a k výměně dat mezi L2 cache jednotlivých jader. Jakmile si jedno z jader vyžádá data od jiného, příslušné jádro zkopíruje modifikovaná data do L3 cache, ze které je možné je přečíst rychleji, než při přenosu přes paměťovou sběrnici. Latence L3 cache bude určitě větší než u L2 cache, a má se měnit v závislosti na zatížení procesoru. V případě, že zátěž nebude příliš vysoká, by měla být nižší, a při vytížení procesoru poroste. Zatím není jasné, jak se to má s frekvencí L3 cache v případě, neboť jednotlivá jádra mohou běžet na různých frekvencích, jak se dočtete dále.

Rozdíly mezi používanými zapojeními L1, L2 a L3 cache u dvou a čtyřjádrových procesorů AMD a Intel jsou zřejmé z následujícíh schémat.

Starší dvoujádrová Pentia postavená na architektuře Netburst vznikla umístěním dvou jednojádrových procesorů do jediné patice. Obě jádra spolu komunikovala přes pomalou sběrnici. Současné dvoujádrové procesory AMD Athlon 64 X2 a Opterony fungují podobně. 

S architekturou Intel Core přišla sdílená L2 cache.

Klepněte pro větší obrázek

Podobně jako v případě dvoujádrových Pentií se u čtyřjádrových Core 2 Quad a Core 2 Extreme QX využívá spojení dvou tentokrát už dvoujádrových procesorů v jedné patici. Jádra spolu opět musí komunikovat přes pomalou systémovou sběrnici. 

Klepněte pro větší obrázek

Dvoujádrové procesory postavené na architektuře K10 mají sdílenou vyrovnávací paměť podobně, jako dvoujádrové Core 2 Duo, navíc má ale každé jádro k dispozici vlastní 512kB L2 cache.

Klepněte pro větší obrázek

U čtyřjádrových procesorů, které AMD označuje jako nativní, neboť nejsou „slepené“ ze dvou nezávislých procesorů, jsou pak spolu všechna jádra na jediném kousku křemíku a krom 512kB L2 cache pro každé jádro sdílejí taktéž společnou L3 cache. Vzájemná komunikace mezi jádry nemusí probíhat přes systémovou sběrnici.

Klepněte pro větší obrázek

Témata článku: Barcelona, Dynamic, Floating, Independent, Budapest, Montreal, Shanghai, Split

42 komentářů

Nejnovější komentáře

  • Federmann 7. 9. 2007 12:32:35
    AMD mělo 5% trhu? a tomu úměrný vliv!
  • Mandarinka 7. 9. 2007 11:46:02
    Chyba lávky. MMX = pouze celočíselné SIMD. 3Dnow = první SIMD i pro...
  • Federmann 7. 9. 2007 11:12:17
    Doplnění: Ten čas od počátku nebyl příliš jasný, zda budou Američané či...
reklama
Určitě si přečtěte

UPC překopli páteřní kabel. V Brně i druhý den nejede internet ani kabelovka

UPC překopli páteřní kabel. V Brně i druhý den nejede internet ani kabelovka

** V Brně byl velký výpadek služeb UPC ** Důvodem je překopnutý páteřní kabel ** V některých lokalitách služby stále nefungují

5.  12.  2016 | Jakub Čížek | 102

17 expertek Microsoftu předpovědělo rok 2027. Splní se alespoň něco?

17 expertek Microsoftu předpovědělo rok 2027. Splní se alespoň něco?

** Zmizí klasické vyhledávače ** Budeme programovat buňky ** Kvantové počítače překonají šifry

6.  12.  2016 | Jakub Čížek | 36

11 tipů na dobrý stolní počítač: od základu po herní mašiny

11 tipů na dobrý stolní počítač: od základu po herní mašiny

** Postavte si stolní počítač! Máme pro vás 11 vzorových sestav s rozpisem komponent ** Většina tipů cílí na hráče, věnujeme se ale i základnímu PC a počítačům na střih videa ** Nadělte si nový počítač třeba pod stromeček

5.  12.  2016 | Adam Kahánek | 74

Nejlepší notebooky nad 20 tisíc: poradíme, které teď chcete

Nejlepší notebooky nad 20 tisíc: poradíme, které teď chcete

** V notebooku s cenou nad 20 tisíc nesmí chybět kvalitní displej a rychlé úložiště ** Za dalších deset tisíc můžete dostat navíc styl nebo výkonnější komponenty ** Vybírat můžete z různých velikostí i konstrukcí

8.  12.  2016 | Stanislav Janů | 82


reklama