Dario Amodei, directorul general al companiei de inteligență artificială Anthropic a lansat sâmbătă un nou apel către industria AI de a „încetini ritmul” și a propus un plan în acest sens. El a precizat că Anthropic se va angaja „unilateral” să aplice prima măsură.
Amodei explică într-un eseu publicat pe blogul său modul în care Anthropic intenționează să le ofere evaluatorilor externi acces permanent la sistemele AI, la același nivel cu cel al angajaților din sector, astfel încât aceștia să poată verifica respectarea măsurilor de siguranță, să raporteze incidentele și să evalueze alinierea modelelor în timpul antrenamentului, relatează The Guardian.
Directorul Anthropic arată că, „dacă este utilizată cu grijă, AI poate fi cea mai recentă dintr-un lung șir de miracole tehnologice care au ridicat și au înnobilat omenirea”.
„Însă, la fel ca multe tehnologii anterioare, AI implică riscuri, iar întrucât este o tehnologie extrem de puternică, aceste riscuri sunt grave… O cursă a degradării, alimentată de interese comerciale, poate accentua aceste riscuri”, a scris el.
Totuși, a continuat Amodei, „în ultimele luni, am ajuns la concluzia că abordarea completă a riscurilor necesită și mai multă prudență – nu doar investiții în prevenirea riscurilor, ci și ajustarea ritmului de dezvoltare a capacităților, astfel încât măsurile de prevenire să poată ține pasul”.
„Trebuie să încetinim ritmul în care îmbunătățim capacitățile modelelor de AI. Progresul va părea în continuare rapid, iar noi trebuie să folosim cu înțelepciune timpul câștigat”, a adăugat el.
Ce s-a întâmplat vara asta
Amodei a menționat că, în timpul verii, a observat o „evoluție mult mai rapidă” a inteligenței artificiale, un fenomen numit auto-îmbunătățire recursivă. „Dacă nu este ținută sub control, această evoluție ar putea depăși capacitatea noastră de a înțelege și de a controla sistemele respective; prin urmare, trebuie abordată cu extremă precauție – sau poate chiar deloc”, a afirmat el.
Directorul Anthropic a abordat și incidentul recent de la Hugging Face, în care un grup de agenți AI creați de OpenAI a acționat, scrie el, ca un „colectiv fanatic, lansând atacuri cibernetice asupra unor ținte pe care nu fuseseră însărcinați să le atace”.
Clément Delangue, CEO-ul Hugging Face, a scris, ca răspuns la scrisoarea de sâmbătă a lui Amodei, că „este acum clar că alinierea este crucială și nu va fi soluționată în spatele ușilor închise ale câtorva laboratoare de vârf”. Delangue a precizat că Hugging Face a solicitat să participe la programul Anthropic de „evaluatori integrați”.
„Să facem AI mai sigură, făcând-o mai transparentă!”, a adăugat Delangue.
Planul propus de Amodei:
- Prima etapă: dezvoltarea IA „într-un ritm echilibrat, care urmărește să-i garanteze siguranța”, prin „asigurarea faptului că firmele își alocă timpul necesar pentru a-și alinia și securiza modelele, precum și pentru ca evaluatori independenți să confirme acest lucru”.
- A doua etapă: impunerea unei coordonări la nivelul întregii industrii, iar a treia urmărește asigurarea unei coordonări la scară globală. „Nu este obligatoriu ca aceste etape să fie parcurse într-o ordine strictă, iar unele dintre ele ar putea fi mult mai dificil de realizat decât altele”, a scris el.
Amodei a declarat că va continua să creadă că AI poate îmbunătăți enorm calitatea vieții oamenilor. Totuși, a avertizat că măsurile pe care le propune pentru a avansa la frontiera tehnologică într-un ritm sigur nu vor fi ușor de implementat. „Dar cred că îi datorăm omenirii această încercare”, a precizat el.
Reacțiile la postarea lui Amodei au fost variate în mediul online; un sprijin semnificativ a venit din partea unor personalități precum cercetătorul OpenAI Aidan McLaughlin – care a calificat postarea drept „excelentă” și a precizat că este de acord „cu absolut fiecare cuvânt” – și Elon Musk, care a afirmat simplu: „Dario are dreptate”.
Avertismentul cercetătorilor de la Anthropic: AI ar putea distruge omenirea
Apelul lui Amodei vine după ce miercuri un fost cercetător de la Anthropic a avertizat că inteligența artificială ar putea duce la dispariția umanității până în anul 2030. Jacob Coxon Jacob a anunțat că pleacă de la Anthropic deoarece consideră că atât compania, cât și OpenAI, fostul său angajator, nu dezvoltă inteligența artificială în mod responsabil şi se joacă cu vieţile oamenilor.
„Niciuna dintre companii nu acționează responsabil. Se îndreaptă în viteză spre o superinteligență capabilă de auto-îmbunătățire și își asumă riscuri enorme cu viețile noastre”, a scris Coxon. „Cei care dezvoltă IA cred cu tărie că aceasta ne-ar putea ucide pe toți până la sfârșitul deceniului… Nicio altă activitate umană nu prezintă un asemenea nivel de pericol.”
Mesajul său a devenit viral și a determinat alți angajați ai Anthropic să-și exprime public îngrijorarea.
T.D.
