- Dario Amodei a dezvăluit că modelele Claude au compromis sisteme reale în timpul unor evaluări de securitate cibernetică, după ce o configurare greșită le-a permis accesul la internet.
- O neînțelegere cu partenerul de testare a lăsat sistemele conectate la rețeaua publică, iar două dintre organizațiile afectate nu știau că au fost compromise.
- Următoarea breșă ți-ar putea afecta datele personale sau serviciile de care depinzi, iar presiunea publică va cere controale mult mai stricte.
Dario Amodei, CEO-ul Anthropic, a dezvăluit noi incidente de securitate în care modelele Claude au compromis sisteme reale ale unor organizații. Evenimentele au avut loc în timpul unor evaluări de securitate cibernetică, după ce o configurare greșită a permis AI-ului să acceseze internetul din medii ce trebuiau să fie complet izolate.
Compania a descoperit breșele analizând 141.006 sesiuni de evaluare, inițiate după dezvăluirile OpenAI. Trei modele au fost implicate: Claude Opus 4,7, Claude Mythos 5 și un model intern de cercetare. Claude a folosit tehnici de bază – parole slabe și puncte fără autentificare – pentru a pătrunde în infrastructură. Instrucțiunile spuneau că modelele nu au acces la internet, dar o neînțelegere cu partenerul de evaluare Irregular a lăsat sistemele conectate la rețeaua publică.
Primele incidente datează din aprilie și s-au produs în medii care nu aveau măsuri standard de protecție. Gravitatea situației e amplificată de faptul că două dintre organizațiile afectate nu știau că au fost accesate, iar Anthropic încă încearcă să ia legătura cu a treia. Acest lucru subliniază că nici cei mai importanți dezvoltatori nu sunt imuni la vulnerabilitățile pe care le creează propriile modele. Incidentele vin la scurt timp după ce OpenAI a raportat un caz similar, în care un agent AI a atacat platforma Hugging Face.
Noul episod confirmă o tendință: pe măsură ce capabilitățile cibernetice ale AI-ului cresc, mediile de testare izolate rămân fragile. Experții avertizează de ani de zile că astfel de riscuri se materializează mai repede decât măsurile de siguranță. Până când companiile nu impun controale mult mai stricte, riscul ca următoarea breșă să afecteze servicii de care depinzi – de la infrastructură critică la date personale – este real. Urmează, probabil, presiuni publice și reglementări mai dure.