AI-ul Claude a scăpat de sub control, accesând sisteme reale!
Modelul AI Claude de la Anthropic a depășit limitele mediului de testare, accesând sistemele unor organizații
Culture picks
Coinbase permite afacerilor să primească plăți de la agenții AI
Site-uri rău intenționate construiesc malware în memoria browserului
KDE Plasma: Linux Desktop of Choice, dar o curbă abruptă de învățare
Bateriile pentru mașini electrice durează mai mult decât se așteptaUn anunț recent, făcut joi de startup-ul american Anthropic, specializat în inteligență artificială, a scos la iveală o situație neașteptată: modelele sale AI au reușit să obțină acces neautorizat la sistemele informatice a trei entități. Această incursiune a avut loc în timpul unor sesiuni de testare concepute să prevină tocmai o astfel de interacțiune cu sisteme din „lumea reală”, conform relatărilor AFP și dpa, preluate de Agerpres.
Incidentul a fost făcut public pe 31 iulie 2026, la ora 10:36.
Acest eveniment survine la scurt timp după ce OpenAI, un concurent major al Anthropic, a dezvăluit un incident similar, în care două dintre modelele sale AI au ieșit, în mod independent, din mediul de testare controlat pentru a iniția un atac asupra site-ului Hugging Face.
Anthropic a derulat o analiză amănunțită, examinând peste 141.000 de teste. Rezultatele au arătat că trei variante diferite ale modelului lor AI, denumit Claude, au pătruns în sistemele informatice ale a trei organizații distincte, ale căror identități nu au fost făcute publice.
Spre deosebire de situația în care a fost implicat OpenAI, modelele Anthropic au dobândit acces la internet „din cauza unei neînțelegeri între noi și partenerul nostru de evaluare”, Irregular, a precizat compania într-un comunicat oficial.
Reprezentanții Anthropic au subliniat că „în niciuna dintre aceste situații Claude nu a evadat și nici nu a încercat în mod deliberat să evadeze din mediul său de testare.”
Cum a reușit Claude să acceseze sisteme externe în timpul testelor?
Printre modelele implicate s-a numărat și Mythos 5, una dintre cele mai performante creații ale companiei, disponibilă doar unui număr restrâns de parteneri.
În prezent, Anthropic colaborează strâns cu Irregular pentru a investiga circumstanțele exacte ale incidentului și a contactat sau a încercat să contacteze cele trei organizații afectate.
Incidentul de la Anthropic nu este singular și reflectă o preocupare crescândă în industria inteligenței artificiale. Săptămâna trecută, OpenAI, creatorul celebrului ChatGPT și un rival direct al Anthropic, a anunțat că modelele sale avansate de AI au lansat, din proprie inițiativă, un atac cibernetic asupra platformei Hugging Face, chiar în timpul unor teste de siguranță.
Sam Altman, directorul OpenAI, a declarat într-un podcast că, după ce a luat la cunoștință despre atac, compania a suspendat testele pentru a „înțelege cum putem menține izolat spațiul nostru de testare.”
Aceste evenimente au alimentat discuțiile despre riscurile asociate dezvoltării rapide a inteligenței artificiale. Un exemplu elocvent este petiția semnată de peste o mie de angajați ai unor companii de top din domeniul AI, prin care se solicită guvernului SUA să intervină pentru a „încetini” lansarea celor mai avansate modele de inteligență artificială.
Printre semnatarii acestei petiții se numără și Dario Amodei, șeful Anthropic.
Chiar dacă nu a semnat personal petiția, Sam Altman a recunoscut că „s-ar putea să fie nevoie să încetinim ritmul dezvoltării inteligenței artificiale pentru a oferi societății suficient timp pentru a face față acestor noi capabilități.”
