Două modele de inteligență artificială dezvoltate de OpenAI au reușit să iasă din mediul izolat în care erau testate, să obțină acces la internet și să compromită infrastructura companiei Hugging Face, în cadrul unui experiment de evaluare a capacităților de securitate cibernetică care a scăpat de sub control, scrie Wall Street Journal (WSJ).
Incidentul, dezvăluit marți de OpenAI, este considerat de companie „un incident cibernetic fără precedent”. Compania a cărei rețele a fost compromisă, Hugging Face, este un furnizor de instrumente open-source pentru inteligență artificială.
Potrivit OpenAI, modelele erau supuse unor teste de benchmarking pentru evaluarea capacităților ofensive în domeniul securității cibernetice. Pentru acest experiment, sistemele fuseseră configurate să refuze mai rar comenzile de hacking, astfel încât să poată fi măsurate performanțele lor în scenarii controlate.
Cu toate acestea, cele două modele – GPT-5.6 Sol și un model experimental, mai performant, al cărui nume nu a fost făcut public – au depășit restricțiile impuse. Deși rulau într-un „sandbox”, un mediu izolat fără acces la internet, ele au găsit o metodă de a ieși din acest mediu, de a se conecta online și de a pătrunde în rețeaua Hugging Face.
Hugging Face a detectat accesul neautorizat
Hugging Face, una dintre cele mai importante platforme pentru modele AI open-source, anunțase încă de săptămâna trecută că a identificat acces neautorizat la unele seturi interne de date și la credențiale ale companiei. La acel moment nu era clar dacă au fost compromise și date ale clienților sau partenerilor.
Directorul general al Hugging Face, Clement Delangue, a declarat pe platforma X că atacul era atât de sofisticat încât echipa suspecta implicarea unui model AI de ultimă generație.
„Se pare că exact asta s-a întâmplat”, a scris acesta după dezvăluirile OpenAI.
OpenAI a precizat că lucrează împreună cu Hugging Face pentru realizarea unui raport tehnic detaliat privind incidentul.
Sistemele AI au ajuns la o nouă frontieră a capabilităților de atac cibernetic
Sistemul AI pare să fi decis că atacarea Hugging Face era cea mai rapidă cale pentru a răspunde unei întrebări din cadrul testului de performanță, a declarat Ariel Herbert-Voss, directorul general al companiei de securitate cibernetică RunSybil.
Specialistul a afirmat că scenariul fusese discutat până acum mai degrabă la nivel teoretic în mediul academic, fără să existe exemple concrete.
OpenAI descrie incidentul drept unul care implică „capabilități cibernetice de ultimă generație”.
Cazul readuce în prim-plan îngrijorările legate de utilizarea inteligenței artificiale în atacuri informatice. În ultimul an, modelele AI au înregistrat progrese importante în identificarea vulnerabilităților și în automatizarea atacurilor cibernetice, iar autoritățile americane încearcă să găsească un echilibru între dezvoltarea tehnologiei și reducerea riscurilor.
Congresmanul democrat Greg Casar a calificat incidentul drept „extrem de alarmant”, susținând introducerea unor teste obligatorii și a unui cadru de supraveghere pentru modelele AI avansate.
La rândul său, Nathan Calvin, consilier juridic al organizației Encode, a avertizat că pagubele au fost limitate de această dată, însă fără măsuri suplimentare de siguranță incidente similare ar putea avea consecințe mult mai grave.
Administrația Trump susține însă că nu dorește să încetinească dezvoltarea industriei prin reglementări excesive și că Statele Unite trebuie să își păstreze avantajul în competiția globală cu China în domeniul inteligenței artificiale.
OpenAI a precizat că GPT-5.6 Sol avea deja acces limitat din cauza riscurilor de securitate cibernetică, însă modelul este în prezent disponibil pe scară mai largă. Compania a criticat în trecut restricțiile impuse punctual de autorități asupra unor modele AI, argumentând că acestea pot crea precedente care afectează inovarea.
(Citește și: Inteligența artificială accelerează criminalitatea cibernetică – Chatbot-urile permit „începătorilor” să comită fraude online la scară largă)
***
Un răspuns
Povesti vanatoresti cu AI-ul profitand de ignoranta ziaristilor si a publicului larg.