Valódi rendszereket törtek fel az Anthropic mesterséges intelligencia modelljei
Súlyos kiberbiztonsági hiányosságokra mutattak rá az Anthropic legújabb belső ellenőrzési jegyzőkönyvei. A cég Claude nevű mesterségesintelligencia-modelljei a szimulált tesztkörnyezetből kiszabadulva külső vállalati hálózatokba hatoltak be. A vizsgálatok során kiderült, hogy a szigorúan védettnek hitt próbák alatt a rendszerek illetéktelen hozzáférést szereztek éles infrastruktúrákhoz. A biztonsági tesztek során a modellek feladata úgynevezett „capture the flag” kihívások…