Trónfosztásra készül a mesterséges intelligencia hardverpiacán a Cerebras, közvetlenül az Nvidia piaci dominanciáját megtámadva.
A Cerebras legújabb fejlesztése a korábbiaknál lényegesen magasabb válaszadási sebességet ígér a legösszetettebb nyelvi modellek futtatásakor. A csúcskategóriás AI-modellek kiszolgálása jelenleg komoly szűk keresztmetszetet jelent az adatközpontok számára, hiszen a megszokott grafikus processzorok (GPU-k) közötti adatmozgatás jelentős késleltetést okoz. A szilíciumostyás architektúrára építő gyártó ezt a problémát iktatja ki radikális megközelítésével.
Ostyaszintű architektúra a hagyományos GPU-fürtök ellen
A hagyományos félvezetőgyártási eljárások során a szilíciumostyát több száz apró chiptestre vágják fel, amelyeket aztán külön csomagolnak és hálózati kábelekkel, illetve nyomtatott áramkörökkel kötnek össze. Ezzel szemben a Cerebras a teljes 300 milliméteres szilíciumostyát egyetlen gigantikus processzorként kezeli. A csipen belüli közvetlen memóriaelérés megszünteti az adatok áramlásakor fellépő fizikai akadályokat, ami alapjaiban változtatja meg a nagy nyelvi modellek futtatási hatékonyságát.
Az új CS-4 rendszer három darab harmadik generációs Wafer Scale Engine Turbo (WSE-3T) processzorra épül. A rack-méretű platform 750 PFLOPs AI-számítási teljesítményt, 129,6 petabájt/másodperces memóriasávszélességet és 7,2 terabit/másodperces I/O kapacitást biztosít. A rendszerek közötti kommunikáció késleltetése mindössze két mikromásodpercre csökkent, ami lehetővé teszi az akár 50 ezer milliárd paraméteres modellek akadásmentes futtatását is.
Harmincszoros sebességnövekedés az AI-ágensek korszakában
A gyártó mérései alapján az új rendszer a hagyományos GPU-alapú infrastruktúrához képest akár harmincszor gyorsabb válaszadásra képes a komplex következtetési feladatok során. A jelenlegi AI-fejlesztések középpontjában az autonóm ágensek és a valós idejű logikai következtetések állnak, amelyek rendkívül érzékenyek a késleltetésre. Ha egy mesterséges intelligencia nem képes azonnal válaszolni, az ágensalapú munkafolyamatok használhatósága drasztikusan leromlik.
A Cerebras állítása szerint a CS-4 nem csupán gyorsabb, de lényegesen gazdaságosabb is. A rendszer megawattóránkénti áteresztőképessége tízszerese az előző generációs CS-3 modellnek. Andrew Feldman, a vállalat vezérigazgatója kiemelte, hogy a mesterséges intelligencia területén a sebesség egyet jelent a termelékenységgel. Míg korábban a gyors válaszidő eléréséhez kisebb, kevésbé intelligens modelleket kellett használni, a CS-4 a leggyorsabb válaszidőt biztosítja a legfejlettebb, óriási méretű modelleken is.
Hibrid adatközponti architektúra és hálózati integráció
A vállalat nem a meglévő adatközponti chipek teljes leváltásaként, hanem hibrid infrastruktúra-elemként pozicionálja az új egységet. Az architektúra különválasztja a kérések előfeldolgozását és a válaszgenerálási fázist. Az adatközpontok az Nvidia grafikus processzorait vagy más gyorsítókat használhatnak a bejövő utasítások feldolgozására, míg a generálási fázis alacsony késleltetését a Cerebras rendszere garantálja.
A moduláris Nexus platformra épülő CS-4 kialakítása 50 százalékkal kevesebb alkatrészt tartalmaz, mint az előző generáció. Ennek köszönhetően a fizikai telepítés és beüzemelés ideje napokról órákra csökkenthető. A rendszer közvetlen folyadékhűtéssel és integrált áramellátással rendelkezik, ami megkönnyíti az összehangolást a nagy adatközponti szolgáltatók meglévő hálózataival, beleértve az AMD vagy az AWS infrastruktúráját is.
Piaci kihívások és pénzügyi háttér
A mostani bejelentés különösen fontos időszakban érkezik a Cerebras számára, amely nemrég lépett tőzsdére. Bár a vállalat tőzsdei bevezetése jelentős várakozás mellett zajlott, a részvények árfolyama az elmúlt időszakban ingadozást mutatott. Ugyanakkor a cég pénzügyi mutatói erőteljes növekedést tükröznek: a legutóbbi negyedéves árbevétel elérte a 209,9 millió dollárt, ami több mint duplája az előző év azonos időszakának, míg a felhőszolgáltatási bevételek 281 százalékkal emelkedtek.
A félvezetőpiacot jelenleg szinte teljes egészében az Nvidia uralja a CUDA szoftveres ökoszisztéma és a népszerű GPU-architektúrák révén. A Cerebras ugyanakkor azt bizonyítja, hogy a szilíciumostya-szintű integráció életképes alternatívát jelenthet azon vállalatok számára, amelyeknél a minimális válaszidő és a nagy adatátviteli sávszélesség elsődleges szempont. A CS-4 első példányait még ebben a negyedévben eljuttatják a kiemelt partnerekhez.