Az amerikai szankciók árnyékában a kínai mesterségesintelligencia-szektor rekordméretű belső megrendeléssel válaszol a piaci kihívásokra. A DeepSeek nem kevesebb mint 160 000 darab Huawei Ascend 950DT mesterségesintelligencia-gyorsító chipet rendelt meg új adatközponti infrastruktúrájához. A nagyszabású beszerzés világosan jelzi, hogy a vezető kínai fejlesztőműhelyek egyre gyorsabb ütemben állnak át a hazai félvezetőgyártók által kínált alternatívákra, csökkentve a külföldi beszállítóktól való függőséget.
Klasszikus chippiac helyett belső ellátási lánc
A megrendelt hardverparkot Belső-Mongóliában, egy gigawattos léptékű adatközpontban állítják üzembe. A helyszínválasztás tudatos stratégia része: az olcsó helyi energiaforrások és a kedvező hűtési feltételek ideális környezetet teremtenek a nagy teljesítményű számítási fürtök folyamatos működtetéséhez. A projekt méreteit jól mutatja, hogy a teljes megrendelés teljesítése akár egy évnél is hosszabb időt vehet igénybe, mivel a gyártó kapacitásait a csúcskategóriás memóriamodulok szűkös elérhetősége és a piaci igények összessége is korlátozza.
A döntés hátterében a szigorú kereskedelmi korlátozások állnak, amelyek elvágták a kínai technológiai cégeket a legfejlettebb nyugati processzorok beszerzésétől. A hazai chipekre való átállás korábban inkább kísérleti jelleggel, kisebb tételben zajlott, mostanra azonban a legmeghatározóbb piaci szereplők is százezres nagyságrendben építik be ezeket az egységeket a termelési rendszereikbe.
Számítási kapacitás és memóriasávszélesség a gyakorlatban
A Huawei Ascend 950DT chipet kifejezetten a nagy memóriasávszélességet igénylő feladatokra tervezték. A hardver lapkánként 144 GB kapacitású, saját fejlesztésű HiZQ 2.0 HBM memóriakialakítást kapott, amely közel 4 TB/s átviteli sebességet biztosít. A chipek közötti közvetlen kommunikációért az új Lingqu összeköttetési protokoll felel, amely optikai kapcsolatokon keresztül 2 TB/s sávszélességet nyújt, és teszi lehetővé a többszáz ezer egységből álló komplexumok összefogását.
A 160 000 darabos állományból álló adatközponti rendszer elméleti csúcsteljesítménye FP8 pontosság mellett eléri a 160 ExaFLOPS értéket, míg FP4 formátumban a 320 ExaFLOPS-ot is megközelíti. A teljes kiépítés összesen mintegy 23 petabájtnyi HBM memóriát mozgat meg. Ez a hatalmas memória-sávszélesség elengedhetetlen ahhoz, hogy a kiépített infrastruktúra egyidejűleg több tízezer felhasználó összetett kéréseit tudja kiszolgálni fennakadás nélkül.
Modellkiszolgálás a tanítás helyett
Érdemes megjegyezni, hogy a DeepSeek a Huawei Ascend 950DT chipeket elsősorban modellkiszolgálásra, vagyis inferenciára szánja, míg a komplex nyelvi modellek alaptanításához továbbra is más architektúrákra támaszkodik. A feladatok szétválasztásának okát a technológiai érettség adja: a jelenlegi hazai gyorsítók a nagy volumenű adatfeldolgozásban és a válaszadási fázisban nyújtják a legmegbízhatóbb teljesítményt.
A kínai félvezetőipar számára az ilyen léptékű megrendelések nemcsak biztos megrendelési állományt jelentenek, hanem valós üzemi visszajelzéseket is adnak a hardverek és a szoftveres környezet finomhangolásához. Bár a szállítási ütemezés nagymértékben függ a chipgyártási kihozataltól, a több mint százezer chipes kiépítés egyértelmű bizonyítéka annak, hogy a kínai mesterségesintelligencia-ökoszisztéma önállósodási törekvései elérték az ipari léptéket.