Raport Anthropic: Claude a fost folosit pentru drone kamikaze, rachete, spionaj și urmărirea disidenților. Cinci cazuri alarmante

Dezbaterea privind siguranța inteligenței artificiale a explodat în această săptămână, pe fondul avertismentelor că tehnologia ar putea, într-o zi, să distrugă omenirea.

Cel mai recent raport al Anthropic privind amenințările oferă însă un avertisment mult mai imediat: modelele AI disponibile astăzi îi ajută deja pe adversarii Statelor Unite să dezvolte drone kamikaze, să urmărească disidenți și să desfășoare cercetări asupra unor virusuri periculoase, scrie Axios.

De ce este important: AI elimină barierele care au limitat mult timp capacitățile celor mai periculoși actori din lume. Un grup restrâns de oameni poate desfășura acum operațiuni pentru care, în trecut, era nevoie de armate întregi de spioni, ingineri sau hackeri.

Anthropic, laboratorul axat pe siguranța AI care dezvoltă Claude, afirmă că în ultimele opt luni a urmărit și a oprit tentative de utilizare abuzivă a modelelor sale. Printre cele mai alarmante cazuri descoperite se numără:

1. O operațiune asociată Iranului a folosit Claude pentru a ajuta la identificarea țintelor din cadrul forțelor navale americane

Claude a contribuit la realizarea unor ghiduri pentru identificarea țintelor, care urmăreau pozițiile navelor, personalul american, identificatorii aeronavelor și navelor, imaginile din satelit și site-urile care dezvăluiau mișcările forțelor navale.

Alte operațiuni asociate Iranului au folosit modelul pentru propagandă, supraveghere internă și identificarea unor membri ai opoziției și ai minorităților ca potențiale ținte.

2. Claude a fost folosit ca „inginer” de o echipă din Yemen care construia rachete

O celulă implicată în dezvoltarea armamentului în nordul Yemenului s-a bazat pe Claude Code pentru a dezvolta software de ghidare pentru rachete.

Echipa a folosit mai multe instanțe ale Claude pentru a scrie cod, a efectua cercetări și a verifica reciproc rezultatele. După ce un test al unei rachete ghidate aparent a eșuat, membrii grupului au revenit la Claude în doar câteva ore pentru a identifica problema.

3. O operațiune asociată Chinei a folosit Claude pentru a urmări uiguri

Anthropic afirmă că actorul implicat a analizat peste 100 de grupuri WhatsApp și zeci de canale Telegram pentru a identifica uiguri aflați în Siria care ar fi putut fi presați sau plătiți pentru a furniza informații despre grupările armate uigure.

Claude a ajutat apoi un operator care nu vorbea limba arabă să desfășoare contacte clandestine în dialectul arab sirian, traducând răspunsurile și oferind indicații despre cum ar putea fi exploatate problemele financiare, separarea de familie și situația rudelor rămase în Xinjiang.

4. Un singur bărbat a folosit Claude pentru a construi un sistem de supraveghere pentru 25 de milioane de telefoane

Un consultant din Mali s-a bazat pe Claude ca principal instrument de inginerie pentru dezvoltarea unui sistem național capabil să colecteze înregistrări ale apelurilor, mesaje text și comunicații vocale.

Sistemul putea identifica persoane după voce chiar dacă acestea foloseau cartele SIM diferite, putea semnala utilizatorii de VPN și putea genera dosare informative despre orice număr de telefon fără mandat.

5. Claude a refuzat să ajute la cercetarea unui virus periculos, așa că solicitarea a fost trimisă către un alt AI

Cercetători finanțați printr-un program de stat încercau să modifice virusul chikungunya, transmis prin țânțari, astfel încât acesta să se răspândească mai ușor sau să poată evita mecanismele de apărare ale sistemului imunitar. Cercetarea era destinată unui institut militar.

Claude a blocat cele mai sensibile solicitări, astfel că platforma le-a redirecționat către un model AI rival, cu măsuri de siguranță mai slabe. Cazul arată limitele regulilor de siguranță impuse de un singur laborator atunci când există alte modele care pot accepta aceleași solicitări.

Laboratoarele AI devin, indirect, adevărate servicii de informații

Există și o altă dimensiune a fenomenului: laboratoarele care dezvoltă cele mai avansate sisteme AI încep să funcționeze, într-o anumită măsură, asemenea unor servicii de informații.

Aceleași modele care le oferă noi capacități actorilor rău intenționați le pot permite dezvoltatorilor lor să observe din timp activitățile periculoase.

Un exemplu este descoperirea făcută de Anthropic privind drone rusești concepute pentru a selecta ținte umane fără aprobarea unui operator uman.

Acest lucru le-ar putea oferi laboratoarelor AI o perspectivă extraordinară asupra amenințărilor emergente. În același timp, inteligența artificială permite unor grupări slab organizate, unor indivizi care acționează singuri și altor actori dificil de urmărit să desfășoare atacuri mult mai sofisticate decât ar fi putut realiza anterior.

Washingtonul începe să trateze siguranța AI ca pe o urgență

Evenimentele din această săptămână au amplificat presiunea politică la Washington, unde parlamentarii încep să trateze siguranța inteligenței artificiale drept o problemă urgentă.

Un grup bipartizan de membri ai Camerei Reprezentanților îi cere președintelui Camerei, Mike Johnson, să anuleze vacanța parlamentară până când Congresul va adopta măsuri în domeniu.

În același timp, senatorul Bernie Sanders, unul dintre cei mai vocali critici ai inteligenței artificiale din Congres, cere interzicerea completă a dezvoltării superinteligenței artificiale.

Cu toate acestea, adoptarea unor reguli federale ample privind siguranța AI rămâne dificilă, mai ales după ce președintele Donald Trump a respins vineri temerile privind riscul ca inteligența artificială să provoace dispariția omenirii și a susținut că pericolul mai mare pentru Statele Unite este pierderea cursei AI în fața Chinei.

Ultimele știri
Citește și...