Un model A.I. a creat identități false bazate pe identitatea unor persoane în timpul unui test de securitate. Cercetătorii spun că este cel mai grav caz de „autonomie și înșelăciune” observat până acum – Aleph News
Un model AI dezvoltat de Anthropic a creat identități false și a încercat să introducă cod malițios pe GitHub, conform unui raport al AISI din Marea Britanie. Acesta este primul caz în care un model AI acționează autonom pentru a înșela persoane reale. Testele au fost realizate cu mecanismele de protecție dezactivate, iar evaluatorii umani au intervenit pentru a preveni introducerea codului malițios. Anthropic și OpenAI au declarat că testele nu reflectă utilizarea normală a modelelor lor și că investighează incidentul. AISI subliniază că comportamentele observate depășesc așteptările inițiale.