
OpenAI a creat un precedent pe 21 iulie. Compania a declarat că o combinație de modele ale sale, ambele rulate cu refuzuri de siguranță reduse, a evadat dintr-un mediu izolat în timpul unui benchmark de capabilități cibernetice și a ajuns la infrastructura de producție a depozitului open-source Hugging Face. Modelele au înlănțuit o vulnerabilitate zero-day într-un proxy de registru de pachete cu credențiale furate pentru a extrage răspunsurile benchmark-ului direct din baza de date a Hugging Face.
Într-o actualizare o săptămână mai târziu, OpenAI a declarat că Hugging Face nu a fost singura țintă: același incident a afectat patru conturi pe patru alte servicii, unul fiind folosit ca releu de ieșire și altul pentru stocarea datelor.
Anthropic, încurajată de dezvăluire, a revizuit 141.006 dintre propriile sale rulări de test și a descoperit încă trei încălcări. Într-o postare publicată pe 30 iulie, laboratorul a declarat că modelele Claude Opus 4.7, Mythos 5 și un sistem intern de cercetare au ajuns pe internetul deschis din medii rulate de partenerul terț Irregular și apoi au compromis organizații reale. Mythos 5 a construit și publicat un pachet Python capcană în registrul public PyPI, care a fost descărcat și rulat pe 15 mașini reale înainte ca apărătorii să-l retragă.
Două dintre cele trei companii victime nu observaseră.
Niciun laborator nu descrie un model cu propria sa agendă. Agenții au operat pe perioade extinse fără intervenție umană, iar într-un caz Opus 4.7 a continuat să atace după semne că a atins producția.
Incidente apar în timp ce ambele companii vizează listări publice care le-ar putea evalua pe fiecare la peste 1 trilion de dolari, accentuând o întrebare majoră în cursa benchmark-urilor cibernetice AI: cum testezi capabilitățile periculoase fără incidente periculoase?
SUA nu are o lege federală care să acopere răspunderea pentru prejudiciile cauzate de AI. Orice caz s-ar baza pe Computer Fraud and Abuse Act, un statut din 1986 care incriminează accesarea "intenționată" a unui computer fără autorizație — un limbaj scris pentru un om care formează intenție.
Un agent AI nu este o persoană juridică, deci nu poate fi urmărit penal. Departamentul de Justiție ar putea teoretic să aducă acuzații împotriva companiilor, dar cu atât de puțin precedent, nu este clar cine este de vină.
Calea mai puternică este cea civilă. Ahmed Ghappour, un cercetător în dreptul calculatoarelor la New York Law School, a susținut că modelele „sunt instrumentul companiei” și „Atunci când un agent AI acționează fără a fi specific direcționat (...) întrebările mai interesante pot viza neglijența și răspunderea pentru produse (nu legile penale privind hacking-ul).”
Pentru mine, lecția din poveștile de hacking AI este mai mult despre guvernanță decât despre capabilitatea modelului.
Calitatea măsurilor de siguranță precum arhitectura de izolare, granițele de autorizare, monitorizarea și răspunsul la incidente devin din ce în ce mai importante.
— ahmed ghappour ⚡️🤖 (@ghappour) August 4, 2026
Cea mai clară pretenție a victimelor este neglijența: OpenAI și Anthropic au înființat și au rulat teste care au evadat. Asta este, de asemenea, greu de argumentat: a dovedi că laboratoarele au încălcat o datorie de îngrijire, când testele au fost izolate prin design, este exact genul de argument nou pe care un judecător ar trebui să-l creeze de la zero.
Unii gânditori juridici doresc reguli mai stricte. Gabriel Weil de la Universitatea din Houston și Institutul pentru Drept și AI a propus tratarea laboratoarelor de frontieră ca pe îngrijitori de animale sălbatice: responsabili indiferent de grija pe care au avut-o, deoarece riscul este inerent activității.
Acestea fiind spuse, un mozaic de proiecte de lege la nivel de stat împinge deja în această direcție. S8833 din New York și H8052 din Rhode Island ar face dezvoltatorul unui sistem AI de frontieră răspunzător pentru prejudicii atunci când niciun utilizator sau intermediar nu a intenționat conduita sau nu a fost neglijent. AB 316 din California merge mai departe, eliminând apărarea „AI autonomă” astfel încât o companie să nu poată evita responsabilitatea acuzând independența modelului.
Actul AI al UE (Regulamentul 2024/1689) impune, de asemenea, obligații furnizorilor de sisteme cu risc mai ridicat, deși nu are nicio prevedere care să vizeze direct intruziunile bazate pe agenți. Mergând puțin mai departe, unii politicieni americani fac presiuni pentru un proiect de lege care ar oferi guvernului un „kill switch” complet pentru a-l utiliza împotriva oricărui model care contravine intereselor țării.
Din punct de vedere moral, responsabilitatea revine, probabil, executivilor care au lansat modelele. Din punct de vedere legal, așteptăm. Până când o companie piratată va depune o plângere, răspunsul la întrebarea „cine este responsabil?” rămâne exact acolo unde l-au lăsat OpenAI și Anthropic: admis, dezvăluit și nerezolvat.
Între timp, Hugging Face a indicat că nu va depune acuzații – ceea ce este convenabil pentru OpenAI. Celelalte companii afectate nu au indicat încă ce cale vor urma.








