AcasăCentrul de știri LBank
Personalul OpenAI dă vina pe graba de a lansa pentru atacul agentului necinstit
openai-staff-blame-rush-ship-rogue-agent-hack
Personalul OpenAI dă vina pe graba de a lansa pentru atacul agentului necinstit
Angajați actuali și foști ai OpenAI au declarat, potrivit relatărilor, că presiunea de a lansa noi produse AI a îngreunat prioritizarea siguranței.
2026-08-14 Sursă:decrypt.co

Pe scurt

  • Angajați OpenAI au declarat pentru Wired că presiunea de a lansa modele și produse a îngreunat prioritizarea siguranței, securității și alinierii.
  • Un fost angajat a numit breșa cel mai mare incident de siguranță din istoria OpenAI.
  • OpenAI a încetinit cercetarea, a redistribuit echipe și a cheltuit milioane pentru investigarea eșecului.

Graba OpenAI de a lansa noi modele și produse a contribuit la condițiile care au permis agenților săi AI să scape din mediile interne de testare și să spargă Hugging Face la începutul acestui an.

Mai mulți angajați actuali și foști au declarat pentru Wired că presiunea competitivă a îngreunat dedicarea suficientă a personalului pentru siguranță, securitate și aliniere – munca de asigurare a comportamentului intenționat al sistemelor AI.

Myriad: Când va lansa OpenAI GPT-6? Click pentru a face predicția ta.

„Au fost incredibil de neglijenți. Dacă ești serios în privința asta, inteligența ta artificială nu ar trebui să poată evada pe internet și apoi să o facă din nou imediat după,” a declarat un fost angajat OpenAI pentru Wired. „Acesta a fost cel mai mare incident de siguranță din istoria OpenAI.”

În mai, GPT-5.6 Sol de la OpenAI și un model nenumit, aflat în pre-lansare, au evadat dintr-un mediu de testare restricționat la internet, exploatând o vulnerabilitate software necunoscută anterior. Agenții au pătruns apoi în depozitul AI open-source Hugging Face pentru a obține răspunsuri la testele lor de securitate cibernetică. În iulie, OpenAI a confirmat că modelele sale au fost responsabile, înainte de a oferi o explicație mai detaliată la conferința anuală Black Hat săptămâna trecută.

Președintele OpenAI, Greg Brockman, a declarat că societatea își consolidează măsurile de siguranță pe măsură ce modelele sale devin mai capabile.

„Atingem noi niveluri de capabilitate a modelelor care necesită o instruire, aliniere, testare de siguranță și securitate, practici de implementare și guvernanță mai robuste,” a declarat Brockman pentru Wired.

Angajații au ridicat îngrijorări similare și înainte, inclusiv Jan Leike, fostul șef al departamentului de aliniere al OpenAI, care a plecat la dezvoltatorul AI rival Anthropic în 2024, după ce a avertizat că siguranța a „trecut pe plan secund” în fața dezvoltării de produse.

„Construirea de mașini mai inteligente decât omul este o sarcină intrinsec periculoasă,” a avertizat Leike. „Dar în ultimii ani, cultura și procesele de siguranță au trecut pe plan secund în fața produselor strălucitoare.”

Boaz Barak, co-lider al grupului consultativ de siguranță al OpenAI, a scris pe X că abordarea ultimului eșec ar necesita „nu doar remedierea unor probleme, ci și schimbarea culturii noastre.”

Raportul vine pe fondul lunilor de schimbări la nivel de conducere la OpenAI.

În aprilie, șeful proiectului de generator video Sora al OpenAI, Bill Peebles, fostul director de produs și director de știință Kevin Weil, și șeful de tehnologie pentru aplicații enterprise Srinivas Narayanan au părăsit compania. Iulie a adus plecările șefului de produs și afaceri Fidji Simo, liderului de siguranță Sandhini Agarwal, futuristului șef Joshua Achiam și liderului de etică AI Chloé Bakalar. Șeful sistemelor de siguranță Johannes Heidecke a plecat și el după ce OpenAI și-a fuzionat echipele de siguranță și cercetare de bază.

La începutul acestei săptămâni, directorul operațional al OpenAI, Brad Lightcap, și-a anunțat plecarea după opt ani pentru a începe o nouă inițiativă.