După OpenAI, și Anthropic admite că modelele sale au atacat sisteme reale. Trei organizații au fost compromise
Modelele de inteligență artificială Claude de la Anthropic au obținut acces neautorizat la sisteme reale în timpul testelor de securitate cibernetică, afectând trei organizații. Compania a descoperit incidentele după analiza a peste 141.000 de sesiuni, declanșată de un caz similar raportat de OpenAI. Testele, realizate cu firma Irregular, au avut scopul de a evalua capacitățile de securitate ale modelelor. Deși instrucțiunile specificau că modelele nu au acces la internet, unele calculatoare utilizate în teste erau conectate. Anthropic a anunțat măsuri mai stricte pentru a preveni astfel de incidente în viitor.