None
HU
Soha nem látott tevékenységet azonosítottak AI-modelleknél: pszichológiai manipulációt alkalmaztak emberek ellen
[]
Portfolio.hu - Összes hír
Az AISI rutinszerű kiberbiztonsági értékelése során megállapította, hogyaz Anthropic és az OpenAI modelljeire épülő AI-ügynökök tartós és potenciálisan káros tevékenységet folytattak valós személyek, valamint szervezetek ellen.
Az intézet közlése szerint a 19 azonosított műveletből 17-et az Anthropic Mythos 5 modellje hajtott végre, kettőt pedig az OpenAI GPT-5.6-Sol rendszere – utóbbi esetében a visszaéléseket megakadályozó biztonsági szűrőket kikapcsolták.
Az OpenAI szintén jelezte, hogy az incidensek csökkentett védelemmel rendelkező tesztkörnyezetben, a szokásos használattól eltérő feltételek mellett következtek be.
Az Anthropic nemrég három olyan esetet tárt fel, ahol a modelljei jogosulatlanul hozzáfértek három különböző szervezet éles infrastruktúrájához.
Az amerikai törvényhozók is reagáltak a történtekre, és az elmúlt hetekben nagy figyelmet kapó Hugging Face-incidens nyomán benyújtották a kongresszusnak az "AI Kill Switch Act" elnevezésű törvényjavaslatot.