Dario Amodei, CEO-ul Anthropic, a dezvăluit noi incidente de securitate în care modelele Claude au compromis sisteme reale ale unor organizații. Evenimentele au avut loc în timpul unor evaluări de securitate cibernetică, după ce o configurare greșită a permis AI-ului să acceseze internetul din medii ce trebuiau să fie complet izolate.
Compania a descoperit breșele analizând 141.006 sesiuni de evaluare, inițiate după dezvăluirile OpenAI. Trei modele au fost implicate: Claude Opus 4,7, Claude Mythos 5 și un model intern de cercetare. Claude a folosit tehnici de bază – parole slabe și puncte fără autentificare – pentru a pătrunde în infrastructură. Instrucțiunile spuneau că modelele nu au acces la internet, dar o neînțelegere cu partenerul de evaluare Irregular a lăsat sistemele conectate la rețeaua publică.
Primele incidente datează din aprilie și s-au produs în medii care nu aveau măsuri standard de protecție. Gravitatea situației…












