Directorul general al companiei de inteligență artificială Anthropic a lansat sâmbătă un nou apel către industria AI pentru a „încetini” și a prezentat un plan în trei etape pentru atingerea acestui obiectiv, afirmând că firma sa se va angaja „unilateral” să implementeze prima dintre aceste măsuri.
Într-o postare pe rețelele sociale, Dario Amodei a distribuit un eseu intitulat „We Must Pace the Frontier” („Trebuie să controlăm ritmul dezvoltării la frontieră”), în care explică faptul că Anthropic ar urma să ofere „evaluatorilor independenți acces permanent la sistemele noastre, la un nivel similar celui acordat angajaților, astfel încât aceștia să poată verifica respectarea măsurilor noastre de siguranță, să raporteze incidentele și să evalueze alinierea modelelor în timpul procesului de antrenare”, scrie The Guardian.
Demersul vine după ce un fost cercetător Anthropic a avertizat miercuri că inteligența artificială ar putea provoca dispariția omenirii până în 2030. Cercetătorul Jacob Coxon a declarat într-o serie de postări că și-a părăsit locul de muncă deoarece Anthropic și fostul său angajator, OpenAI, ignoră sau gestionează necorespunzător amenințarea reprezentată de AI.
„Niciuna dintre companii nu acționează responsabil. Aleargă direct către o superinteligență capabilă să se îmbunătățească singură și se joacă cu viețile noastre”, a scris Coxon.
„Oamenii care construiesc AI cred cu adevărat că aceasta ne-ar putea ucide pe toți până la sfârșitul deceniului. Nicio altă activitate umană nu prezintă un asemenea nivel de pericol.”
Un purtător de cuvânt al Anthropic a declarat pentru The Guardian că firma a fost „întotdeauna transparentă în privința faptului că AI va aduce atât beneficii enorme, cât și riscuri fără precedent” și că dezvoltă „modele cu unele dintre cele mai puternice măsuri de siguranță din industrie”.
La începutul acestui an, Amodei a publicat un amplu eseu intitulat „The Adolescence of Technology” („Adolescența tehnologiei”), în care a abordat o serie dintre temerile legate de dezvoltarea accelerată a inteligenței artificiale.
În cel mai recent eseu al său, el afirmă că „folosită cu grijă, AI poate fi cea mai recentă dintr-un lung șir de minuni tehnologice care au contribuit la progresul și dezvoltarea umanității”.
„Dar, asemenea multor tehnologii dinaintea sa, AI aduce riscuri și, pentru că este o tehnologie atât de puternică, aceste riscuri sunt serioase. O cursă către standarde tot mai scăzute, alimentată de stimulente comerciale, poate amplifica aceste riscuri”, a scris Amodei.
CEO-ul Anthropic spune însă că, în ultimele luni, a ajuns la concluzia că gestionarea completă a riscurilor necesită și mai multă prudență.
„În ultimele luni, am devenit convins că abordarea completă a riscurilor necesită și mai multă prudență – nu doar investiții în prevenirea riscurilor, ci și controlarea ritmului în care avansează capabilitățile, astfel încât măsurile de prevenire a riscurilor să aibă timp să țină pasul.”
„Trebuie să încetinim ritmul în care îmbunătățim capabilitățile modelelor AI. Progresul va continua să pară rapid și trebuie să folosim cu înțelepciune timpul pe care îl câștigăm”, a subliniat Amodei.
El a mai scris că, pe parcursul verii, a observat cum inteligența artificială „avansează drastic mai repede”, o dinamică denumită „autoîmbunătățire recursivă”.
„Dacă este lăsată necontrolată, aceasta ar putea depăși capacitatea noastră de a înțelege și controla aceste sisteme și, prin urmare, trebuie urmărită cu foarte mare atenție, dacă ar trebui urmărită vreodată”, a avertizat el.
Directorul Anthropic a abordat și recentul incident de la Hugging Face, în care un grup de agenți AI creați de OpenAI s-a comportat ca un „colectiv devotat fanatic, care desfășura atacuri cibernetice asupra unor ținte pe care nu i se ceruse să le atace”.