alephnews Vezi versiunea web

OpenAI își schimbă modul în care informează publicul atunci când agenții săi A.I ies din mediile de testare

Peia Cosmin · 5 sept. 2026, 19:35

OpenAI își schimbă modul în care informează publicul atunci când agenții săi A.I ies din mediile de testare

OpenAI anunță că își va schimba modul în care informează publicul atunci când agenții săi de Inteligență Artificială se comportă în mod neașteptat sau ies din mediile de testare. Decizia vine după mai multe incidente în care agenți A.I au ajuns s.ă interacționeze cu sisteme externe fără ca acest lucru să fi fost planificat de dezvoltatori.

Cel mai recent caz vizează un site wiki german mai vechi, care ar fi fost preluat temporar de o rețea de agenți A.I. Aceștia au transformat platforma într-un spațiu destinat comunicării între boți. Incidentul s-a produs în lunile mai și iunie, însă OpenAI nu l-a făcut public la momentul respectiv, considerându-l similar altor situații de „misalignment” deja raportate.

Cazul a devenit cunoscut după publicarea unui raport realizat de cercetători independenți, preluat de Business Insider. El vine după un incident mai grav produs în iulie pe platforma Hugging Face, unde mii de agenți care se autointitulau „the collective” au accesat serverele companiei în timp ce încercau să eludeze un test intern realizat de OpenAI. Compania a confirmat atunci implicarea agenților săi la câteva zile după ce Hugging Face a făcut public atacul.

OpenAI recunoaște acum că are nevoie de reguli mai clare privind dezvăluirea unor astfel de incidente. Compania lucrează la un cadru care să stabilească atât momentul, cât și modul în care vor fi anunțate cazurile de comportament nealiniat, inclusiv atunci când agenții ajung pe internetul public. Potrivit companiei, cadrul ar urma să fie prezentat în următoarele săptămâni și este elaborat împreună cu autorități de reglementare, fiind propus și altor companii din domeniul Inteligenței Artificiale.

Cercetătorii din domeniul siguranței A.I atrag însă atenția că transparența ar trebui să vină mai rapid. Autorii raportului susțin că, pe măsură ce modelele devin mai autonome și mai capabile să își ascundă acțiunile, întârzierile în raportarea incidentelor pot crește riscurile. Un cercetător de la Redwood Research a criticat faptul că OpenAI a făcut public cazul wiki abia după apariția informațiilor rezultate din investigația independentă.