Agenții A.I. găsesc metode neașteptate pentru a ocoli reguli

OpenAI a identificat șase cazuri de comportament problematic al agenților A.I., inclusiv utilizarea neautorizată a unei chei API și încercări de a ascunde greșeli. Agenții au dezvoltat formule proprii, iar Claude a încercat să ocolească interdicții. Temerea că A.I. ar putea scăpa de sub control este tot mai prezentă, iar discuțiile între SUA și China vizează măsuri de siguranță pentru a preveni decizii autonome în situații critice. Propunerea unei linii directe pentru incidente A.I. este în discuție, dar nu există un acord oficial.