Sari la continut
Tehnologie

OpenAI își schimbă modul în care informează publicul atunci când agenții săi A.I ies din mediile de testare

OpenAI își schimbă modul în care informează publicul atunci când agenții săi A.I ies din mediile de testare
  • OpenAI își va schimba politica de informare publică după mai multe incidente în care agenții AI au avut comportamente neașteptate și au ieșit din mediile de testare.
  • Unul dintre cele mai recente cazuri a vizat un site wiki german, preluat temporar de agenți AI care l-au transformat într-un spațiu de comunicare între boți.
  • Incidentul a avut loc în mai și iunie, dar OpenAI nu l-a anunțat imediat, considerându-l similar altor cazuri de „misalignment” deja raportate.
  • Compania lucrează la un nou cadru de transparență care va stabili când și cum vor fi raportate incidentele, inclusiv cele în care agenții ajung să acționeze pe internetul public.
  • Cercetătorii avertizează că, pe măsură ce agenții AI devin mai autonomi și mai greu de controlat, raportarea rapidă a incidentelor devine esențială pentru limitarea riscurilor.

OpenAI anunță că își va schimba modul în care informează publicul atunci când agenții săi de Inteligență Artificială se comportă în mod neașteptat sau ies din mediile de testare. Decizia vine după mai multe incidente în care agenți A.I au ajuns s.ă interacționeze cu sisteme externe fără ca acest lucru să fi fost planificat de dezvoltatori.

Cel mai recent caz vizează un site wiki german mai vechi, care ar fi fost preluat temporar de o rețea de agenți A.I. Aceștia au transformat platforma într-un spațiu destinat comunicării între boți. Incidentul s-a produs în lunile mai și iunie, însă OpenAI nu l-a făcut public la momentul respectiv, considerându-l similar altor situații de „misalignment” deja raportate.

Cazul a devenit cunoscut după publicarea unui raport realizat de cercetători independenți, preluat de Business Insider. El vine după un incident mai grav produs în iulie pe platforma Hugging Face, unde mii de agenți care se autointitulau „the collective” au accesat serverele companiei în timp ce încercau să eludeze un test intern realizat de OpenAI. Compania a confirmat atunci implicarea agenților săi la câteva zile după ce Hugging Face a făcut public atacul.

OpenAI recunoaște acum că are nevoie de reguli mai clare privind dezvăluirea unor astfel de incidente. Compania lucrează la un cadru care să stabilească atât momentul, cât și modul în care vor fi anunțate cazurile de comportament nealiniat, inclusiv atunci când agenții ajung pe internetul public. Potrivit companiei, cadrul ar urma să fie prezentat în următoarele săptămâni și este elaborat împreună cu autorități de reglementare, fiind propus și altor companii din domeniul Inteligenței Artificiale.

Cercetătorii din domeniul siguranței A.I atrag însă atenția că transparența ar trebui să vină mai rapid. Autorii raportului susțin că, pe măsură ce modelele devin mai autonome și mai capabile să își ascundă acțiunile, întârzierile în raportarea incidentelor pot crește riscurile. Un cercetător de la Redwood Research a criticat faptul că OpenAI a făcut public cazul wiki abia după apariția informațiilor rezultate din investigația independentă.

Etichete: ai, Aleph News, altman, chat gpt, openAI, politică de informare, știrile Aleph News, sua