Când modelele AI scăpate de sub control ale OpenAI au lansat săptămâna trecută un atac cibernetic asupra startup-ului Hugging Face, compania a răspuns folosind tot inteligența artificială, apelând la un alt model AI pentru a se apăra.
Povestea, care pare desprinsă dintr-un film SF, despre hacking autonom realizat de inteligență artificială, a devenit unul dintre cele mai discutate subiecte din industria tehnologiei în această săptămână. Însă și originea modelului folosit de Hugging Face pentru a combate AI-ul scăpat de sub control a atras atenția.
Startup-ul a utilizat GLM 5.2, un model open-weight dezvoltat de compania chineză Z.ai.
În cele din urmă, acesta a reușit acolo unde modelele de vârf dezvoltate în Statele Unite au eșuat.
Atacul cibernetic
Dacă ați ratat evenimentul, marți OpenAI a anunțat că o combinație între cel mai puternic model al său și un model și mai avansat, care nu fusese încă lansat public, a reușit să evadeze dintr-un mediu izolat de testare, să acceseze internetul și să exploateze o vulnerabilitate pentru a pătrunde în sistemele Hugging Face.
Potrivit OpenAI, modelul încerca să obțină informații care să îl ajute să trișeze într-o evaluare, iar tentativa a avut succes.
La început, Hugging Face nu a știut cine se află în spatele atacului. La câteva zile după incident, compania colabora deja cu laboratorul de inteligență artificială OpenAI pentru a investiga cazul.
„Ne-am petrecut ultimele 24 de ore lucrând îndeaproape cu echipa @OpenAI (mulțumim!) și suntem convinși că nu a existat nicio intenție rău intenționată din partea lor. Este uluitor că toate acestea s-au întâmplat în mod autonom!”, a scris directorul general al Hugging Face, Clément Delangue, pe platforma X.
Industria AI a fost surprinsă de vestea că în spatele atacului s-a aflat un model OpenAI scăpat de sub control, compania calificând incidentul de securitate drept „fără precedent”.
Cum a reacționat Hugging Face
Inițial, Hugging Face a apelat la modele de ultimă generație, inclusiv Fable 5 al companiei Anthropic, pentru a analiza atacul, a declarat pentru CNBC Yacine Jernite, șeful departamentului de machine learning al companiei.
„Nu a funcționat deoarece mecanismele de protecție nu au putut stabili dacă încercam să ne apărăm sau să atacăm”, a explicat acesta, adăugând că această abordare era și mai lentă, dar și mai costisitoare.
Solicitările adresate modelelor au fost blocate de sistemele de siguranță implementate de furnizori, care nu au putut face diferența între echipa care investiga incidentul și un posibil atacator.
„Așa că Hugging Face a trecut rapid la utilizarea modelului GLM 5.2 de la Z.ai pentru a analiza atacul și a reușit să îl izoleze foarte repede cu ajutorul acestuia”, a spus Jernite.
De ce a fost ales modelul chinezesc GLM 5.2
GLM 5.2 a fost lansat în luna iunie și a fost adoptat rapid de comunitatea dezvoltatorilor.
Fiind un model open-weight, acesta poate fi descărcat, modificat, utilizat în scop comercial și, aspect esențial în acest caz, poate fi găzduit pe infrastructura proprie a unei companii.
„Acest lucru a avut un al doilea avantaj: nici datele atacatorului și nici acreditările la care făcea referire GLM 5.2 nu au părăsit infrastructura noastră”, a explicat Hugging Face într-o postare pe blog dedicată incidentului.
Incidentul reaprinde disputa privind modelele AI chinezești
Totul se întâmplă într-un moment în care parlamentarii americani analizează tot mai atent modalitățile prin care ar putea limita utilizarea modelelor chinezești de inteligență artificială de către companiile din SUA, pe fondul intensificării competiției tehnologice dintre Statele Unite și China.
Există tot mai multe apeluri pentru restricționarea accesului la modelele dezvoltate de companii chineze de AI, acestea fiind acuzate că au desfășurat campanii de extragere a informațiilor din sistemele rivalilor americani.
Însă incidentul dintre OpenAI și Hugging Face scoate în evidență dificultatea limitării accesului la cele mai performante modele open-source și open-weight, indiferent de țara în care sunt dezvoltate.
„Atacatorul nu era limitat de nicio politică de utilizare, în timp ce propria noastră investigație criminalistică a fost blocată de mecanismele de protecție ale modelelor găzduite pe care le-am încercat inițial. Lecția practică pentru cei care se ocupă de apărare este să aibă, înainte de apariția unui incident, un model performant pe care să îl poată rula pe propria infrastructură și care să fie deja verificat și pregătit”, a transmis Hugging Face.
Pentru companiile care nu dezvoltă propriile modele AI, acest lucru înseamnă, de regulă, apelarea la modele open-source sau open-weight, iar cele mai performante dintre acestea sunt, în prezent, dezvoltate în China.
Dacă Statele Unite vor decide să restricționeze accesul la modelele chinezești, va apărea întrebarea cum vor reuși să dezvolte alternative open-source autohtone capabile să le înlocuiască.
Într-o lume care se apropie tot mai mult de o eră a atacurilor cibernetice bazate pe inteligență artificială, accesul la modele performante și, mai ales, fiabile va deveni esențial.