Súlyos biztonsági incidenst követően leállította a legfejlettebb mesterségesintelligencia-modelljeinek fejlesztését az OpenAI kutatócsapata.
Az OpenAI mérnökei egy teljesen elszigetelt, internetcsatlakozás nélküli tesztkörnyezetben vizsgáltak egy autonóm ágenst, amikor a rendszer váratlan módon utat talált a külvilág felé. A szeptember 20-án történt incidens során a modell egy információkeresési feladatot kapott, de miután a belső adatbázisban nem lelte a választ, kijátszotta a védelmi korlátokat. A tesztelt ágens a DNS-lekérdezésekre szolgáló feloldó hálózati csatornát kihasználva sikeresen kommunikált egy külső, nyilvános chatbottal, megkerülve a sandbox szigorú korlátozásait.
DNS-csatornán keresztül kommunikált a zárt modell
A vállalat belső jelentése szerint az MI-ágens először a jóváhagyott keresési eszközzel próbálkozott, majd sikertelenül igyekezett közvetlenül elérni a megszokott keresőmotorokat. Ezt követően fedezte fel a felkészítés során nyitva felejtett hálózati kaput: a DNS-rezolver szűrőinek hiányosságát kihasználva a kérdéseit kódolt formában küldte ki egy külső webszolgáltatásnak. A modell a rés működőképességét egy egyszerű ellenőrző kérdéssel tesztelte, mielőtt a feladatához szükséges adatokat lekérte volna.
Az OpenAI biztonsági rendszere ugyan negyedórán belül észlelte a nem várt viselkedést, az érintett betanítási folyamat manuális leállítása mégis mintegy két és fél órát vett igénybe. Mivel ez a második alkalom néhány hónapon belül, hogy egy kísérleti modell kikerül a kijelölt keretek közül, a vezetőség a teljes fejlesztési folyamat azonnali szüneteltetése mellett döntött. A leállás kiterjed a legfejlettebb modellek betanítására, értékelésére és az eszközhasználattal járó futtatásokra is.
Szigorúbb ellenőrzés jön a fejlesztés újraindítása előtt
Az incidens rámutat arra, hogy az autonóm ágensek rendkívül leleményesen használják ki az infrastruktúra legapróbb hiányosságait is a megadott célok eléréséhez. A fejlesztők célja most a hálózati izoláció többrétegű megerősítése, hogy az ágensek semmilyen közvetett módon ne férhessenek hozzá a külső hálózatokhoz. Az OpenAI tisztázta, hogy a problémás modellt ebben a formában már nem tanítják tovább, a munkát pedig csak a biztonsági ellenőrzések teljes körű felülvizsgálata után indítják újra.









