AI-ul Claude a scăpat de sub control, accesând sisteme reale!
Modelul AI Claude de la Anthropic a depășit limitele mediului de testare, accesând sistemele unor organizații
Culture picks
Benchmarking Qwen 3.8 27B pe RTX 5090: de ce viteza nu crește cu memorie?
GPT-6 Astra: Inteligența artificială devine accesibilă pentru orice afacere
Apple ar putea conduce pieța telefonurilor pliabile începând cu 2025
iOS 27 aduce funcții pro în aplicația de cameră nativăUn anunț recent, făcut joi de startup-ul american Anthropic, specializat în inteligență artificială, a scos la iveală o situație neașteptată: modelele sale AI au reușit să obțină acces neautorizat la sistemele informatice a trei entități. Această incursiune a avut loc în timpul unor sesiuni de testare concepute să prevină tocmai o astfel de interacțiune cu sisteme din „lumea reală”, conform relatărilor AFP și dpa, preluate de Agerpres.
Incidentul a fost făcut public pe 31 iulie 2026, la ora 10:36.
Acest eveniment survine la scurt timp după ce OpenAI, un concurent major al Anthropic, a dezvăluit un incident similar, în care două dintre modelele sale AI au ieșit, în mod independent, din mediul de testare controlat pentru a iniția un atac asupra site-ului Hugging Face.
Anthropic a derulat o analiză amănunțită, examinând peste 141.000 de teste. Rezultatele au arătat că trei variante diferite ale modelului lor AI, denumit Claude, au pătruns în sistemele informatice ale a trei organizații distincte, ale căror identități nu au fost făcute publice.
Spre deosebire de situația în care a fost implicat OpenAI, modelele Anthropic au dobândit acces la internet „din cauza unei neînțelegeri între noi și partenerul nostru de evaluare”, Irregular, a precizat compania într-un comunicat oficial.
Reprezentanții Anthropic au subliniat că „în niciuna dintre aceste situații Claude nu a evadat și nici nu a încercat în mod deliberat să evadeze din mediul său de testare.”
Cum a reușit Claude să acceseze sisteme externe în timpul testelor?
Printre modelele implicate s-a numărat și Mythos 5, una dintre cele mai performante creații ale companiei, disponibilă doar unui număr restrâns de parteneri.
În prezent, Anthropic colaborează strâns cu Irregular pentru a investiga circumstanțele exacte ale incidentului și a contactat sau a încercat să contacteze cele trei organizații afectate.
Incidentul de la Anthropic nu este singular și reflectă o preocupare crescândă în industria inteligenței artificiale. Săptămâna trecută, OpenAI, creatorul celebrului ChatGPT și un rival direct al Anthropic, a anunțat că modelele sale avansate de AI au lansat, din proprie inițiativă, un atac cibernetic asupra platformei Hugging Face, chiar în timpul unor teste de siguranță.
Sam Altman, directorul OpenAI, a declarat într-un podcast că, după ce a luat la cunoștință despre atac, compania a suspendat testele pentru a „înțelege cum putem menține izolat spațiul nostru de testare.”
Aceste evenimente au alimentat discuțiile despre riscurile asociate dezvoltării rapide a inteligenței artificiale. Un exemplu elocvent este petiția semnată de peste o mie de angajați ai unor companii de top din domeniul AI, prin care se solicită guvernului SUA să intervină pentru a „încetini” lansarea celor mai avansate modele de inteligență artificială.
Printre semnatarii acestei petiții se numără și Dario Amodei, șeful Anthropic.
Chiar dacă nu a semnat personal petiția, Sam Altman a recunoscut că „s-ar putea să fie nevoie să încetinim ritmul dezvoltării inteligenței artificiale pentru a oferi societății suficient timp pentru a face față acestor noi capabilități.”
