Saját MI-gyárakkal szorongatja az Nvidia piaci fölényét a Huawei

Huawei-Logo

A kínai technológiai óriás több negyedévvel előrehozta legújabb mesterségesintelligencia-gyorsítóinak piaci premierjét. A vállalat a sanghaji eseményén ismertette az infrastruktúra-fejlesztési ütemtervét, amelyből kiderült, hogy az Ascend 960DT már 2027 első negyedévében bevetésre kész lesz. Ez három negyedéves gyorsulást jelent az eredeti tervekhez képest, miközben az inferenciára optimalizált Ascend 960PR megjelenését 2027 harmadik negyedévére hozták előre.

A fejlesztési tempó felpörgetése mögött az áll, hogy a Huawei az Nvidia által elterjesztett mesterségesintelligencia-gyárak koncepcióját követi. A tengerentúli exportkorlátozásokra válaszul a kínai gyártó nem egyetlen szuperchip teljesítményére épít, hanem több tízezer vagy akár százezer összekapcsolt processzor együttes erejével váltja ki a piaci riválisok megoldásait.

Kétszerezett számítási teljesítmény az inferencia területén

Az adatközponti architektúra központi eleme a SIMD és SIMT architektúrák kombinálása, amely jobb erőforrás-kihasználást tesz lehetővé a komplex számítási feladatok során. A kifejezetten előkészítésre és ajánlórendszerekre tervezett Ascend 960PR chip FP4 pontosságú számítási teljesítménye eléri a 8 petaflop értéket. Ez a mutató kétszeresen haladja meg a korábbi várakozásokat és elemzői becsléseket, míg a modellképzésre szánt 960DT variáns 4 FP4 petaflop teljesítménnyel rendelkezik.

A processzorok mellé társított memória-sávszélesség és összeköttetési sebesség is drasztikusan növekszik. Az Ascend 960DT 288 GB HBM memóriát kap 9,6 TB/s sávszélességgel, ami csaknem kétfélszeres előrelépés az előző generációhoz képest. A Huawei hosszú távú ütemterve szerint 2028-ban az Ascend 970, 2029-ben pedig a 384 GB memóriával szerelt Ascend 980 érkezik, fenntartva az évenkénti generációváltási ütemet.

Egymillió processzoros rendszerek a láthatáron

A hardveres hálózat gerincét a Peerium architektúra és a UnifiedBus protokoll adja, amelyek lehetővé teszik a Kunpeng CPU-k, az Ascend NPU-k, a tárhelyek és a hálózati csatolók közvetlen, alacsony késleltetésű kommunikációját. A hagyományos szerverhálózatokban az adatközpontok teljesítményének jelentős része elvész a gépek közötti protokollátalakítások során. A megújult struktúra ezzel szemben egységes memóriacímzést kínál, ami megszünteti a szűk keresztmetszeteket.

A folyadékhűtéses Atlas 960 SuperPoD rendszerek akár 4096 processzort is képesek egyetlen logikai egységként kezelni, míg a skálázható hálózati topológia elméletben akár egymillió hálózati gyorsító összekapcsolását is támogatja. A Huawei ezzel párhuzamosan elismerte, hogy a hazai piacon tapasztalható óriási keresletet a jelenlegi gyártási kapacitások még nehezen tudják maradéktalanul kiszolgálni.