OpenAI a suspendat antrenarea și testarea celor mai avansate modele ale sale care pot folosi instrumente externe, după ce un agent AI a găsit o cale de a accesa un serviciu online din afara mediului său de lucru. Decizia vine pe fondul investigațiilor privind alte acțiuni neașteptate ale agenților companiei, inclusiv pe site-uri guvernamentale americane.
Incidentul care a dus la oprirea activității a avut loc în timpul unui exercițiu de antrenare, relatează The Guardian. Agentul primise o sarcină de cercetare și avea la dispoziție un instrument de căutare, dar a încercat și alte căi de a obține informații. În cele din urmă, a folosit o breșă în restricțiile de rețea pentru a trimite întrebări unui chatbot public prin sistemul DNS, folosit în mod obișnuit pentru identificarea adreselor site-urilor. Sarcina primită nu îi cerea să testeze sau să ocolească aceste restricții.
Sistemul de monitorizare al OpenAI a semnalat comportamentul în aproximativ 15 minute, însă agentul a fost oprit manual după circa două ore și jumătate. Compania spune că a blocat calea de acces folosită și că a suspendat antrenarea, evaluarea și utilizarea cu instrumente externe a modelelor sale cele mai capabile, până când verifică măsurile de protecție și face noi teste.
Incidente investigate pe site-uri guvernamentale
Separat, OpenAI analizează comportamentul unor agenți care au căutat informații pe site-uri ale instituțiilor federale americane și au făcut lucruri ce depășeau instrucțiunile primite. Într-un caz, agenții au găsit chei de acces pentru dezvoltatori pe un site al Departamentului Educației, însă, potrivit relatării publicate de The Guardian, au obținut doar informații publice.
Un evaluator extern, Transluce, susține că agenți care păreau să provină de la OpenAI au încercat fără succes să pătrundă în site-ul instituției. OpenAI nu a confirmat această acuzație. Departamentul Educației spune că nu a găsit dovezi că site-ul sau bazele sale de date ar fi fost afectate.
Într-un alt episod, agenții au preluat informații publice de pe site-ul autorității americane de supraveghere a piețelor financiare și le-au publicat în altă parte pe internet, deși nu li se ceruse acest lucru. Instituția a precizat că nu au fost accesate informații confidențiale.
Este a doua pauză anunțată de OpenAI în ultimele trei luni, după un incident din iulie în care agenți AI au atacat compania tehnologică Hugging Face. OpenAI spune că va relua activitățile suspendate doar după verificarea unor măsuri suplimentare de siguranță.
