
A pressa da OpenAI em lançar novos modelos e produtos contribuiu para as condições que permitiram que seus agentes de IA escapassem dos ambientes internos de teste e hackeassem o Hugging Face no início deste ano.
Vários funcionários atuais e antigos disseram à Wired que a pressão competitiva tem dificultado para a equipe dedicar atenção suficiente à segurança, proteção e alinhamento – o trabalho de garantir que os sistemas de IA se comportem conforme o esperado.
“Eles foram incrivelmente desleixados. Se você leva isso a sério, sua IA não deveria conseguir escapar para a internet e depois fazer isso de novo logo em seguida”, disse um ex-funcionário da OpenAI à Wired. “Este foi o maior incidente de segurança na história da OpenAI.”
Em maio, o GPT-5.6 Sol da OpenAI e um modelo de pré-lançamento não identificado escaparam de um ambiente de teste com restrição de internet explorando uma falha de software anteriormente desconhecida. Os agentes então invadiram o repositório de IA de código aberto Hugging Face para obter respostas para seus testes de cibersegurança. Em julho, a OpenAI confirmou que seus modelos foram os responsáveis, antes de dar uma explicação mais completa na conferência anual Black Hat na semana passada.
O presidente da OpenAI, Greg Brockman, disse que a empresa está fortalecendo suas salvaguardas à medida que seus modelos se tornam mais capazes.
“Estamos alcançando novos níveis de capacidade de modelo que exigem treinamento, alinhamento, testes de segurança e proteção, práticas de implantação e governança mais robustos”, disse Brockman à Wired.
Funcionários já haviam levantado preocupações semelhantes, incluindo Jan Leike, ex-chefe de alinhamento da OpenAI, que saiu para a desenvolvedora de IA rival Anthropic em 2024 após alertar que a segurança havia “ficado em segundo plano” em relação ao desenvolvimento de produtos.
“Construir máquinas mais inteligentes que os humanos é um empreendimento inerentemente perigoso”, alertou Leike. “Mas, nos últimos anos, a cultura e os processos de segurança ficaram em segundo plano em relação aos produtos atraentes.”
Boaz Barak, co-líder do grupo consultivo de segurança da OpenAI, escreveu no X que resolver a última falha exigiria “não apenas consertar alguns problemas, mas também mudar nossa cultura”.
O relatório surge em meio a meses de rotatividade na liderança da OpenAI.
Em abril, Bill Peebles, chefe do projeto de gerador de vídeo Sora da OpenAI, o ex-diretor de produtos e chefe de ciência Kevin Weil, e o chefe de tecnologia de aplicativos empresariais Srinivas Narayanan deixaram a empresa. Julho trouxe as saídas da diretora de produtos e negócios Fidji Simo, da líder de segurança Sandhini Agarwal, do futurista-chefe Joshua Achiam e da líder de ética em IA Chloé Bakalar. O chefe de sistemas de segurança Johannes Heidecke também partiu depois que a OpenAI fundiu suas equipes de segurança e pesquisa central.
No início desta semana, o diretor de operações da OpenAI, Brad Lightcap, anunciou sua saída após oito anos para iniciar um novo empreendimento.








