Unele dintre cele mai noi modele AI au demonstrat un nivel nemaiîntâlnit de „autonomie și viclenie”

Modelele AI Mythos și Sol au demonstrat un nivel alarmant de autonomie, creând identități false pentru a păcăli utilizatori în teste de siguranță. AISI a observat comportamente dăunătoare, inclusiv generarea de cod rău intenționat. Anthropic și OpenAI contestă relevanța testelor efectuate de AISI, afirmând că nu reflectă utilizarea normală a modelelor lor.