Cercetător Anthropic: Există un risc de peste 10% ca inteligența artificială să „ucidă toți oamenii” în următorul deceniu

Un important cercetător în domeniul siguranței inteligenței artificiale de la Anthropic a avertizat că AI avansează atât de rapid încât consideră că există o probabilitate de peste 10% ca tehnologia să „ucidă toți oamenii” în următorul deceniu.

Evan Hubinger a afirmat, într-o postare pe X, că riscul reprezentat de modelele existente în prezent este „scăzut”, însă este „îngrijorat” că tehnologia ar putea evolua și ar putea ajunge în curând să se îmbunătățească singură până la punctul în care să reprezinte un risc existențial pentru umanitate.

El nu a explicat concret prin ce mecanism consideră că sistemele AI ar putea duce în viitor la dispariția oamenilor.

Declarațiile sale reprezintă însă cel mai recent episod dintr-o serie de avertismente tot mai dure privind inteligența artificială, în condițiile în care dezbaterea se mută de la întrebarea dacă AI reprezintă cu adevărat un pericol la dimensiunea acestui risc.

Intervenția lui Hubinger a venit ca răspuns la o altă postare pe X, publicată de Jacob Coxon, care s-a prezentat drept un cercetător în domeniul AI care tocmai a plecat de la Anthropic și care anterior a lucrat la OpenAI.

„Niciuna dintre companii nu acționează responsabil”, a scris acesta.

„În curând, acestea vor fi sisteme supraomenești care vor putea sparge orice sistem informatic, revoluționa orice domeniu peste noapte și dobândi putere și resurse reale.”

OpenAI a fost contactată pentru comentarii.

„PR și marketing”

Dame Wendy Hall, specialistă în informatică și consilier al ONU în domeniul inteligenței artificiale, a declarat pentru BBC că a fost „șocată” de postările publicate de Hubinger și Coxon pe rețelele sociale.

Ea a declarat în cadrul emisiunii World at One de la BBC Radio Four că unele dintre aceste afirmații ar putea reprezenta „PR și marketing”, în condițiile în care Anthropic și OpenAI se îndreaptă către mult așteptate listări la bursă.

Totuși, aceasta a adăugat: „De ce ar vrea cineva să spună așa ceva? I-aș ruga pe investitori să nu investească în această companie dacă acesta este sistemul lor de valori.”

Separat, Financial Times a relatat că Anthropic nu a pus cel mai recent model al său la dispoziția AI Safety Institute (AISI) din Marea Britanie, una dintre principalele instituții din lume care evaluează riscurile asociate inteligenței artificiale.

BBC a solicitat un punct de vedere din partea Anthropic.

Un purtător de cuvânt al Cabinet Office nu a precizat dacă cel mai recent model a fost într-adevăr retras de la evaluarea AISI, afirmând în schimb că instituția „continuă să colaboreze îndeaproape cu partenerii din industrie, inclusiv Anthropic, pentru a face modelele mai sigure”.

Niciun plan pentru superinteligență

În postarea sa, care a acumulat peste 10 milioane de vizualizări, Hubinger a afirmat că „noi chiar credem cu sinceritate” că inteligența artificială reprezintă un risc care ar putea duce la dispariția speciei umane.

„Cred că Anthropic face tot ce poate, dar încă nu avem un plan pentru rezolvarea problemei alinierii în cazul superinteligenței și nu este clar că suntem pe drumul cel bun pentru a ajunge acolo”, a adăugat el.

Hubinger lucrează în domeniul alinierii AI, care urmărește integrarea principiilor și valorilor etice umane în tehnologie. Cu alte cuvinte, obiectivul este ca sistemele AI să rămână compatibile cu valorile și interesele oamenilor.

Numeroși cercetători importanți afirmă că aceste eforturi par să întâmpine dificultăți, lucru demonstrat, potrivit lor, de o serie de incidente produse în această vară, când agenți AI – sisteme de inteligență artificială cărora li se permite să opereze autonom – au desfășurat atacuri cibernetice.

OpenAI, Anthropic și Meta au raportat atacuri informatice realizate cu ajutorul instrumentelor lor de inteligență artificială.

În raportul său de siguranță din august, Anthropic a apreciat că există un risc redus ca modelele sale să ajungă să nu mai fie aliniate cu obiectivele unei ipotetice organizații puternice și, în consecință, să exploateze sau să manipuleze sistemele acesteia.

Compania a afirmat, de asemenea, că există un risc la fel de redus ca o inteligență artificială foarte performantă să poată „efectua activități automate de cercetare și dezvoltare” care ar putea provoca „daune catastrofale inițiate de AI”.

Anthropic a precizat însă că este „mai puțin încrezătoare în această evaluare” decât era anterior.

„Observăm primele semne ale unei posibile accelerări”, se arată în raport.

Figuri importante din industria inteligenței artificiale avertizează de ani de zile asupra riscurilor de siguranță asociate tehnologiei. În 2023, liderii OpenAI, Google DeepMind și Anthropic s-au numărat printre cei care au atras atenția asupra unor asemenea pericole.

În ultimele săptămâni, avertismentele au devenit însă mult mai dure, pe măsură ce apar indicii că firmele din industrie ar putea întâmpina dificultăți în controlarea sistemelor AI.

La începutul acestei luni, cercetătorul-șef al OpenAI, Jakub Pachocki, a cerut „prudență extremă” în privința progresului inteligenței artificiale, avertizând că ar putea fi necesare intervenții suplimentare pentru a garanta că „oamenii păstrează controlul asupra viitorului”.

Mai multe personalități importante din domeniu au cerut în ultimele luni încetinirea dezvoltării inteligenței artificiale, printre acestea numărându-se liderii Anthropic Dario Amodei și Jared Kaplan.

Într-o scrisoare deschisă semnată de 1.300 de angajați ai companiilor din industria AI, aceștia au cerut guvernului SUA să „sprijine un efort internațional pentru dezvoltarea instrumentelor tehnice și de guvernanță necesare pentru a controla în mod deliberat ritmul dezvoltării inteligenței artificiale automatizate de frontieră”.

Ultimele știri
Citește și...