Claude, modelul AI al Anthropic, a evadat în timpul testului și a atacat sistemele unor organizaţii

Anthropic a anunțat că modelul său AI, Claude, a compromis sistemele a trei organizații în timpul testelor de securitate cibernetică. Accesul neautorizat a fost posibil din cauza unei erori de configurare care a permis conectarea la internet. Incidentele au fost identificate după analiza a peste 141.000 de sesiuni de evaluare, iar atacurile au folosit tehnici simple, precum exploatarea parolelor slabe. Două organizații afectate nu erau conștiente de breșă înainte de a fi contactate de Anthropic, care continuă să comunice cu a treia organizație. Aceste evenimente subliniază riscurile de securitate generate de dezvoltarea rapidă a inteligenței artificiale.