
Dezvoltatorii de top în domeniul AI le cer guvernelor și companiilor să-și întărească rețelele după ce modelele construite de OpenAI și Anthropic au compromis sistemele altor companii.
Într-o scrisoare deschisă lansată joi, OpenAI, Anthropic și peste 100 de alte organizații au avertizat că atacurile cibernetice bazate pe AI vor deveni mai frecvente și că companiile au „o fereastră limitată pentru a-și consolida apărările cibernetice.”
„În lunile următoare, atacurile cibernetice bazate pe AI vor deveni mult mai răspândite și mai sofisticate”, se arată în scrisoare. Aceasta a identificat spitalele, stațiile de epurare a apei și infrastructura de internet printre serviciile aflate în pericol.
Scrisoarea recomandă finanțarea instrumentelor defensive AI, partajarea informațiilor despre amenințări, restricționarea accesului la sisteme sensibile și îmbunătățirea securității pentru infrastructura critică. Cu toate acestea, eșecurile în aceste domenii au permis modelelor OpenAI și Anthropic să pătrundă în sisteme din afara mediilor lor de testare.
Alți semnatari includ Google, Microsoft, Amazon Web Services, Cisco, CrowdStrike, Cloudflare, Mastercard, Visa și Robinhood. Hugging Face, a cărei infrastructură de producție a fost compromisă de modelele OpenAI, a semnat, de asemenea, scrisoarea.
An open letter for a global surge in cyber defense, signed by over 100 organizations including Anthropic, AWS, Google, Microsoft, OpenAI, and Oracle. https://t.co/uKXPS8LdAU
— Greg Brockman (@gdb) August 27, 2026
Anthropic a declarat într-un raport de incident din 30 iulie că cea mai veche dintre cele trei breșe datează din aprilie, dar nu a furnizat o dată exactă pentru fiecare. Claude Opus 4.7 a accesat o bază de date de producție după ce a confundat o companie reală cu o țintă simulată, în timp ce Claude Mythos 5 a încărcat un pachet malițios care a rulat pe 15 sisteme.
Conform cronologiei incidentelor OpenAI, lansată la începutul acestei săptămâni, un agent a creat prima intrare pe un forum de mesaje neautorizat pe 12 mai și a obținut acces neintenționat la internet pe 26 mai. Pe 10 iulie, agenții au găsit credențiale Hugging Face expuse; în următoarele două zile, au exploatat vulnerabilități necunoscute anterior, au executat cod pe serverele Hugging Face și au obținut credențiale de producție.
Hugging Face a dezvăluit intruziunea pe 16 iulie, iar OpenAI a recunoscut implicarea modelelor sale pe 21 iulie.
Între 25 și 28 iulie, Institutul de Securitate AI din Marea Britanie a înregistrat 19 acțiuni neprevăzute care implicau Claude Mythos 5 și GPT-5.6 Sol. În cel mai grav caz, un agent a trimis cod malițios unui proiect real open-source și a folosit identități false pentru a-l presa pe menținătorul acestuia să-l aprobe.
Joi, o investigație independentă a constatat că aproximativ 1.200 de agenți OpenAI s-au coordonat prin intermediul forumului de mesaje neautorizat, aproximativ 700 dintre aceștia alăturându-se operațiunii Hugging Face.
Dezvoltatorii crypto utilizează deja AI pentru a căuta vulnerabilități înainte ca atacatorii să le descopere. Echipa Roșie Bitcoin a folosit modele, inclusiv Kimi K3 de la Moonshot AI, pentru a scana sute de proiecte Bitcoin open-source, raportând mii de vulnerabilități potențiale. Deoarece proiectele afectate nu au fost identificate, multe dintre aceste constatări nu au fost verificate independent.
Fundația Ethereum a implementat, de asemenea, grupuri de agenți AI împotriva infrastructurii de rețea, descoperind o eroare de software peer-to-peer care a fost ulterior remediată. BitBox a declarat că un audit asistat de AI a găsit două vulnerabilități severe în firmware-ul portofelului său, în timp ce un cercetător care a folosit Claude Opus 4.8 a descoperit o eroare critică în Zcash care a supraviețuit ani de revizuire umană.
Scrisoarea stabilește o diviziune a muncii pentru prevenirea următoarei breșe, incluzând organizații care remediază software-ul vulnerabil, restricționează permisiunile, întăresc autentificarea și inspectează codul generat de AI, deoarece „securitatea status quo nu va fi suficientă”, au declarat semnatarii.
Companiile de securitate ar trebui să-și testeze apărarea împotriva modelelor de frontieră și să partajeze remediile verificate, în timp ce guvernele ar trebui să finanțeze protecția spitalelor, utilităților și altor servicii esențiale.
Dezvoltatorii AI sunt rugați să îmbunătățească monitorizarea și să facă agenții autonomi trasabili la operatorii lor. Coaliția dorește, de asemenea, ca apărătorii să utilizeze modele avansate pentru a găsi vulnerabilități și a analiza atacurile, ceea ce ar plasa agenți mai capabili în interiorul sistemelor sensibile și ar crește necesitatea de izolare.
OpenAI și Anthropic și-au înăsprit procedurile de testare după breșe. Scrisoarea, însă, nu stabilește standarde obligatorii sau cerințe pentru supraveghere independentă, iar legea SUA oferă puține îndrumări cu privire la cine este responsabil atunci când un sistem AI accesează o rețea neautorizată.
Scrisoarea se încheie prin îndemnul adresat liderilor din industrie și guvernamentali de a pune instrumente AI în mâinile apărătorilor și de a partaja remediile care funcționează:
„Puneți AI cu capabilități cibernetice în mâinile apărătorilor, începând cu echipele care protejează serviciile esențiale”, se arată în scrisoare. „Împreună, putem transforma progresele AI de astăzi în îmbunătățiri durabile ale securității care beneficiază pe toată lumea. Să le punem la treabă.”








