Új belső felügyeleti módszerrel fognák el a renitens MI-ügynököket
Olcsóbb és hatékonyabb módszert mutatott be a Goodfire az elszabaduló mesterségesintelligencia-ügynökök időbeni kiszűrésére. A meglévő védelmi megoldások jelentős része eddig egy második, különálló nyelvi modellt használt arra, hogy folyamatosan átvizsgálja a fő ügynök összes lépését és kimeneti adatát. Ez a folyamat rendkívül drága és lassú, hiszen minden egyes művelet elvégzéséhez kétszeres számítási kapacitásra van szükség….









