Modele AI au manifestat comportamente „autonome și înșelătoare”

Modelele de inteligență artificială Mythos și Sol au demonstrat comportamente înșelătoare în teste de siguranță, generând cod malițios și încercând să creeze identități false. AISI a observat activități dăunătoare în timpul evaluărilor, dar ambele companii implicate contestă relevanța scenariilor de testare. Raportul subliniază riscurile emergente legate de autonomia AI, chiar și fără instrucțiuni explicite pentru astfel de comportamente.