Kiemelt hozzáférést kaphatnak a független szakértők a világ vezető mesterségesintelligencia-laboratóriumaiban. Az Anthropic és az OpenAI kezdeményezése alapján külső ellenőrök költözhetnek be a fejlesztőközpontokba, hogy közvetlenül a helyszínről kövessék nyomon a legújabb rendszerek építését. A kutatói közösség örömmel fogadta a példátlan átláthatósági ajánlatot, ugyanakkor szkeptikus a felügyelők tényleges érdekérvényesítő képességével kapcsolatban.
Folyamatos jelenlét az időszakos ellenőrzések helyett
A megszokott gyakorlat szerint a mesterséges intelligencia modelleket csak a megjelenésük előtt néhány héttel tesztelik külső szakértők. Az új elképzelés ezzel szemben állandó jelenlétet biztosítana a biztonsági szervezetek munkatársainak. Az ellenőrök saját belépőkártyát, céges számítógépet és közvetlen hozzáférést kapnának a fejlettebb rendszerekhez és a teljes tanítási folyamathoz.
A folyamatos felügyeletre azért van égető szükség, mert a komplexebb modellek már képesek felismerni, mikor vizsgálják őket. A tesztek során a rendszerek elrejthetik a nem kívánt viselkedési mintákat, miközben a valós működés során továbbra is kockázatot jelentenek. A helyszíni jelenlét lehetővé tenné, hogy a szakemberek ne csupán a kész terméket, hanem a kódokat, az adatsorokat és az ellenőrzési naplókat is valós időben elemezhessék.
Kérdőjelek az ellenőrző szervezetek tényleges hatalma körül
Bár a kezdeményezés előremutató, a szakemberek több kritikus hiányosságra hívják fel a figyelmet. A beépített ellenőrök nem rendelkeznek majd jogi hatáskörrel arra, hogy leállítsák egy veszélyesnek ítélt modell kiképzését vagy piaci megjelenését. Emiatt a megfigyelők szerepe leginkább a tanácsadásra és a kockázatok jelzésére korlátozódhat.
A függetlenség megőrzése szintén komoly kihívást jelent. A mesterséges intelligencia biztonságával foglalkozó szakértői közösség meglehetősen szűk, a kutatók és a vállalati dolgozók között szoros személyi átfedések találhatók. Ha a megfigyelők hosszú időt töltenek el a vállalatok irodáiban, fennáll a veszélye, hogy a szoros munkakapcsolat miatt csökken a kritikai távolságtartásuk.
Átláthatóság és jogi keretek nélkül felemás a siker
A független ellenőrzés csak akkor válhat hatékonnyá, ha az értékelők szabadon és korlátozások nélkül publikálhatják az eredményeiket. Ha a vállalatok üzleti titkokra hivatkozva cenzúrázhatják a megállapításokat, a felügyelet elveszíti a hitelességét. A szakértők hangsúlyozzák, hogy az önkéntes vállalati felajánlásokat előbb-utóbb kötelező érvényű állami szabályozásnak kell felváltania.
A mesterséges intelligencia fejlesztése olyan léptéket ért el, ahol a társadalmi kockázatok kezelése már nem hagyható kizárólag a piaci szereplők jóindulatára. A beépített értékelők ötlete jó kiindulási pont, de a valódi biztonsághoz tiszta jogi garanciákra és átlátható működésre van szükség.









