Nem hagyatkozhatunk a mesterséges intelligenciát fejlesztő cégek puszta ígéreteire a rendkívül fejlett rendszerek biztonságával kapcsolatban. Satya Nadella egy átfogó bejegyzésben vázolta fel a technológiai szektor előtt álló egyik legnagyobb kihívást, hangsúlyozva, hogy a legfejlettebb modelleket alapértelmezés szerint kompromittáltként kell kezelni.
Belső veszélyforrásként kezelt mesterséges intelligencia
A vezető megközelítése szerint a vállalatoknak pontosan úgy kell hozzáállniuk a határokat feszegető nyílt és zárt kódú modellekhez, mint a szervezeten belüli potenciális biztonsági kockázatokhoz. Ez nem azt jelenti, hogy a rendszerek rosszindulatúak lennének, hanem azt, hogy a hozzáféréssel rendelkező fejlett ágensek hibázhatnak vagy külső befolyás alá kerülhetnek. Mivel a hagyományos szoftverekkel ellentétben az MI-modellek döntései nem követhetők vissza egyértelmű kódsorokra, a felelősség kiszervezése a fejlesztőkre súlyos hiba lenne.
A külső vészfék szerepe a biztonsági architektúrában
A javasolt védelmi stratégia kulcseleme a vezérlés és az intelligenciaellátás teljes szétválasztása. A nem determinisztikus modelleket olyan kötött, külső rendszerekkel kell körülvenni, amelyek felett közvetlen emberi ellenőrzés marad. Satya Nadella ezt egy fizikai vészfékhez hasonlította, amely lehetővé teszi a felhatalmazott kezelők számára, hogy feladatvégzés közben is azonnal leállítsák vagy szüneteltessék a modellt. A korlátozásoknak és hozzáférési jogosultságoknak a modellen kívül kell elhelyezkedniük, így maga az algoritmus nem tudja megkerülni saját szabályrendszerét.
Szigorúbb iparági szabványokra van szükség
A biztonsági keretrendszer több alapvető elvre épül, amelyek célja a transzparencia és a számonkérhetőség fenntartása. A legfontosabb ajánlások között szerepel:
- A modellek műveleteiről hamisításbiztos, ember által is olvasható naplót kell vezetni.
- A kritikus döntéshozatalt nem szabad egyetlen modellre bízni.
- Független biztonsági auditoknak és folyamatos tesztelésnek kell alávetni a rendszereket.
- A váratlan incidensekről és kompromittálódásokról haladéktalanul tájékoztatni kell az érintetteket.
A megközelítés lényege, hogy a legmegbízhatóbb rendszert nem a leginkább megbízható modell hozza létre, hanem az az architektúra, amely a legkevesebb feltétlen bizalmat igényli az algoritmus irányába.









