openai

Kiberbiztonsági kockázatok és felügyeleti aggályok kísérik az OpenAI Astra érkezését

Ijesztő kiberbiztonsági képességei miatt a szakértők komoly veszélyekre figyelmeztetnek az OpenAI Astra modelljének debütálása előtt. Az OpenAI eddigi legfejlettebb rendszere olyan szintű autonómiát mutat a hálózati támadások terén, amely korábban elképzelhetetlen volt emberi közreműködés nélkül. Autonóm támadási képességek a kritikus küszöb felett Az OpenAI hivatalos kockázatértékelési keretrendszerében az Astra az első olyan modell, amely elérte…

Teljes cikk
anthropic

Így olvasnak a kutatók a Claude gondolataiban: Felfedezték a rejtett J-teret

Saját belső gondolati teret fejlesztett ki a Claude mesterséges intelligencia, amit a kutatóknak most sikerült teljesen leleplezniük. Az Anthropic interpretabilitási csapata egy vadonatúj matematikai eljárással térképezte fel a Claude rejtett működését, az úgynevezett J-teret. Ez a csendes belső zóna radikálisan eltér a korábban látott gondolati láncoktól, és bizonyítja, hogy a nagy nyelvi modellek képesek olyan…

Teljes cikk