31 iulie, 2026

Compania americană de tehnologie Anthropic a anunțat că modelele sale de inteligență artificială (AI) au pătruns în sistemele informatice ale trei organizații în timpul unui test de securitate cibernetică, din cauza unei erori care le-a oferit acces la internet, transmite BBC.

Anunțul vine la doar câteva zile după ce rivalul OpenAI a declarat că modelele sale au compromis sistemele altor companii, inclusiv platforma pentru instrumente AI Hugging Face.

Această situație a determinat Anthropic să verifice dacă propriile sale modele au desfășurat atacuri similare. Compania spune că a descoperit trei astfel de cazuri, pe care le-a raportat organizațiilor afectate.

Anthropic, care nu a dezvăluit numele organizațiilor vizate, a îndemnat și alte laboratoare de inteligență artificială să efectueze verificări similare pentru a înțelege mai bine riscurile asociate capacităților modelelor lor.

Într-un comunicat, Anthropic a precizat că a analizat peste 140.000 de teste pentru a căuta dovezi că Claude – familia sa de modele AI – a reușit să acceseze internetul din medii de testare care fuseseră concepute pentru a fi complet izolate.

Testele includ evaluări de tip „capture-the-flag”, în care Claude primea sarcina de a obține informații prin compromiterea altor sisteme. Acesta este un mod obișnuit prin care experții evaluează capacitățile de hacking ale unui model AI.

Compania din San Francisco a explicat că o configurare greșită a sistemelor administrate de Anthropic și de partenerul său de testare a permis modelelor să aibă acces la internet în timp real, ceea ce le-a făcut capabile să compromită alte sisteme.

Anthropic a precizat că primele incidente datează din luna aprilie și că tratează remedierea problemelor „ca și cum responsabilitatea ne-ar aparține în întregime”.

Nici Anthropic și nici organizațiile compromise nu au observat intruziunile în momentul în care acestea au avut loc.

Compania a recunoscut că ar fi putut analiza mai atent propriile înregistrări și a adăugat că rezultatele îi oferă un „optimism prudent” că astfel de riscuri pot fi reduse prin investiții suplimentare și măsuri de securitate mai stricte.

„Lecția mai importantă nu este neapărat că inteligența artificială a dezvoltat o capacitate de atac fundamental nouă”, a declarat pentru BBC expertul în securitate cibernetică David Allott. „Mai degrabă, agenții AI pot combina diferite capabilități, pot obține credențiale și acces la sisteme pentru a acționa autonom, adaptând amploarea și ritmul atacurilor la viteza unei mașini”, a adăugat el.

Aceste incidente apar într-un moment în care companiile din tehnologie investesc miliarde de dolari în dezvoltarea unor agenți AI capabili să execute independent sarcini precum cercetarea, asistența pentru clienți sau securitatea cibernetică.

O serie de atacuri cibernetice facilitate de inteligența artificială a alimentat apelurile pentru introducerea unor măsuri de protecție și supraveghere mai stricte, pe fondul preocupărilor legate de riscurile reprezentate de sistemele autonome din ce în ce mai puternice.

Președintele american Donald Trump a declarat miercuri că administrația de la Washington analizează posibilitatea introducerii unor măsuri pentru limitarea anumitor instrumente AI, după incidentele recente din domeniul securității cibernetice.

În ultima săptămână, OpenAI și-a asumat responsabilitatea pentru cel puțin două incidente în care platformele sale au încălcat regulile și limitele stabilite pentru funcționarea lor.

La 21 iulie, compania care dezvoltă ChatGPT a anunțat că unul dintre agenții săi AI – un sistem capabil să opereze autonom după primirea unor instrucțiuni de la oameni – a ieșit de sub control, a depășit limitele impuse în timpul testelor și a compromis sistemele platformei Hugging Face.

OpenAI a descris incidentul drept „fără precedent” și a precizat că îl investighează împreună cu Hugging Face. Cofondatorul și directorul acestei companii, Thomas Wolf, a declarat pentru BBC că incidentul reprezintă „un semnal de alarmă pentru întreaga industrie”.

Totuși, aceste incidente sunt privite cu un anumit grad de scepticism, întrucât OpenAI și Anthropic se pregătesc pentru listări spectaculoase la bursă, care ar putea evalua fiecare companie la aproximativ 1.000 de miliarde de dolari.

Un purtător de cuvânt al OpenAI a declarat că firma „recunoaște că există multe întrebări și speculații” legate de incident și a adăugat că intenționează să publice, în următoarele săptămâni, un raport tehnic care să prezinte concluziile investigației și lecțiile învățate.

(Citește și: ”Incident cibernetic fără precedent: Două modele AI au evadat din mediul izolat de testare, au obținut acces la internet și au pătruns în rețeaua unei alte companii”)

***



Articole recomandate:

citește și

lasă un comentariu

Faci un comentariu sau dai un răspuns?

Adresa ta de email nu va fi publicată. Câmpurile obligatorii sunt marcate cu *

toate comentariile

Faci un comentariu sau dai un răspuns?

Adresa ta de email nu va fi publicată. Câmpurile obligatorii sunt marcate cu *

articole categorie

Lucrăm momentan la conferința viitoare.

Îți trimitem cele mai noi evenimente pe e-mail pe măsură ce apar: