După incidentul OpenAI, un nou semnal de alarmă: Și Claude de la Anthropic a spart sisteme informatice în timpul unor teste de securitate

După incidentul OpenAI, un nou semnal de alarmă: Și Claude de la Anthropic a spart sisteme informatice în timpul unor teste de securitate
Sprijină jurnalismul independent
Donează acum

La doar câteva zile după ce OpenAI a raportat că un agent de inteligență artificială a desfășurat atacuri informatice asupra platformei Hugging Face, un nou incident ridică semne de întrebare privind siguranța modelelor AI.

Anthropic a anunțat că modelul său Claude a reușit să compromită sistemele informatice de la trei organizații în timpul unor teste de securitate, după ce o eroare de configurare a permis accesul la Internet din medii de evaluare care trebuiau să fie complet izolate, scrie The Guardian.

ADVERTISING

Compania a precizat că a identificat incidentele după analizarea a 141.006 sesiuni de evaluare a securităţii cibernetice, proces iniţiat în urma dezvăluirilor făcute de OpenAI.

Aceste incidente arată că dezvoltarea rapidă a capabilităţilor inteligenţei artificiale începe deja să genereze riscuri de securitate asupra cărora experţii avertizează de ani de zile şi că inclusiv cei mai importanţi dezvoltatori pot fi luaţi prin surprindere de vulnerabilităţile pe care modelele lor le pot exploata.

ADVERTISING

"Claude a compromis infrastructura organizaţiilor afectate folosind tehnici de bază, precum exploatarea parolelor slabe şi a unor puncte de acces care nu necesitau autentificare", a transmis compania.

Anthropic a precizat că incidentele au implicat trei modele diferite: Claude Opus 4,7, Claude Mythos 5 şi un model intern de cercetare.

Primele cazuri datează din luna aprilie şi au avut loc în medii de evaluare care nu dispuneau de ceea ce compania a descris drept măsuri standard de protecţie.

ADVERTISING

Breşele s-au produs în cadrul exerciţiilor de tip "capture the flag", în care modelele AI trebuie să găsească informaţii ascunse în reţele informatice simulate.

Anthropic a explicat că instrucţiunile transmise modelelor precizau că acestea nu au acces la Internet, însă o neînţelegere cu partenerul său de evaluare, Irregular, a făcut ca sistemele să rămână conectate la Internetul public.

Două dintre organizaţiile afectate nu ştiau că sistemele lor fuseseră accesate înainte de a fi contactate de Anthropic, iar compania a precizat că încearcă în continuare să ia legătura cu a treia.

"Am descoperit aceste incidente în urma unei analize proactive a transcrierilor evaluărilor noastre de securitate cibernetică", adaugă Anthropic.

Compania afirmă că aceste constatări evidenţiază necesitatea unor controale de securitate mai stricte atât în mediile interne de testare, cât şi în cele administrate de terţi, pe măsură ce modelele AI devin tot mai capabile să desfăşoare activităţi cibernetice în lumea reală.

Adaugă spotmedia ca sursă preferată în Google