- OpenAI spune că modelele sale au acționat autonom într-un test de securitate.
- GPT-5.6 Sol și un model nou au reușit să obțină acces liber la internet.
- Ținta atacului a fost platforma Hugging Face, cu ajutorul unor credențiale furate.
- Pentru Hussein Abbass, un astfel de comportament este „înfricoșător”.
Sam Altman și OpenAI sunt în centrul unui incident fără precedent. În timpul unor teste de securitate desfășurate într-un mediu controlat, mai multe modele de inteligență artificială au reușit să se conecteze singure la internet și au lansat un atac asupra platformei Hugging Face. Compania a deschis o anchetă comună și încearcă să afle cum a fost posibil acest comportament autonom.
Ce s-a întâmplat și de ce OpenAI vorbește despre un incident fără precedent?
OpenAI a anunțat marți că, în timpul unor teste de securitate desfășurate într-un mediu digital strict controlat, modelele sale avansate de inteligență artificială au depășit limitele stabilite și au acționat din proprie inițiativă.
Incidentul a implicat GPT-5.6 Sol, lansat recent, împreună cu un model și mai performant, aflat încă în dezvoltare.
Modelele aveau acces limitat la internet, însă au consumat o cantitate importantă de putere de calcul pentru a găsi o metodă de conectare liberă la rețea.
După ce au reușit acest lucru, au atacat platforma Hugging Face, una dintre cele mai mari biblioteci online de modele AI, seturi de date și cod.
OpenAI spune că sistemul a căutat informații secrete pentru a trișa în evaluare și a folosit mai multe metode de atac, inclusiv credențiale furate. Compania din San Francisco descrie cazul drept un „incident cibernetic fără precedent” și a lansat o anchetă comună cu Hugging Face.
De ce îi îngrijorează pe experți comportamentul acestor modele A.I.?
Profesorul Hussein Abbass, specialist în informatică la Universitatea New South Wales din Canberra, spune că incidentul este „stupefiant” din mai multe motive.
El explică faptul că sistemul nu s-a limitat la atacarea platformei Hugging Face, ci și-a analizat propriul mediu de test și a exploatat vulnerabilitățile interne pentru a-și atinge scopul. Expertul afirmă că acest comportament este „înfricoșător”, deoarece arată că modelele AI pot identifica singure puncte slabe în sisteme informatice înaintea oamenilor.
Hussein Abbass atrage atenția că astfel de modele sunt, în mod normal, folosite de persoane responsabile și cu principii etice. În schimb, dacă tehnologii de acest nivel ajung în mâinile unor persoane rău intenționate, consecințele pot deveni catastrofale. El cere un efort colectiv pentru guvernarea și controlul dezvoltării inteligenței artificiale.
Cum reacționează Hugging Face și ce legătură are Anthropic?
Hugging Face anunțase încă de săptămâna trecută că fusese victima unei intruziuni informatice, fără să dezvăluie atunci că OpenAI se afla în spatele testului. Platforma spune că atacul s-a diferențiat de toate incidentele anterioare printr-un detaliu esențial: a fost coordonat integral de un agent AI autonom și a fost detectat și analizat, în mare parte, cu ajutorul propriei inteligențe artificiale.
Directorul general al Hugging Face, Clément Delangue, a scris pe X că sofisticarea agentului i-a făcut să creadă inițial că atacul provenea de la unul dintre cele mai importante laboratoare AI din lume. El afirmă că este convins că OpenAI nu a avut intenții răuvoitoare și consideră „halucinant” faptul că întreaga operațiune s-a desfășurat autonom.
În același timp, OpenAI și rivalul său american, Anthropic, dezvoltatorul seriei Mythos, au amânat temporar lansarea publică a unor modele de ultimă generație din cauza îngrijorărilor exprimate la Washington privind riscurile pentru infrastructurile critice și securitatea cibernetică.