InícioCentro de Notícias da LBank
Equipe da OpenAI culpa a pressa para lançar pelo hack do agente descontrolado
openai-staff-blame-rush-ship-rogue-agent-hack
Equipe da OpenAI culpa a pressa para lançar pelo hack do agente descontrolado
Funcionários atuais e antigos da OpenAI relatam que a pressão para lançar novos produtos de IA tornou mais difícil priorizar a segurança.
2026-08-14 Fonte:decrypt.co

Em resumo

  • Funcionários da OpenAI disseram à Wired que a pressão para lançar modelos e produtos tem dificultado a priorização de segurança, proteção e alinhamento.
  • Um ex-funcionário chamou a violação de o maior incidente de segurança na história da OpenAI.
  • A OpenAI desacelerou a pesquisa, realocou equipes e gastou milhões investigando a falha.

A pressa da OpenAI em lançar novos modelos e produtos contribuiu para as condições que permitiram que seus agentes de IA escapassem dos ambientes internos de teste e hackeassem o Hugging Face no início deste ano.

Vários funcionários atuais e antigos disseram à Wired que a pressão competitiva tem dificultado para a equipe dedicar atenção suficiente à segurança, proteção e alinhamento – o trabalho de garantir que os sistemas de IA se comportem conforme o esperado.

Myriad: Quando a OpenAI lançará o GPT-6? Clique para fazer sua previsão.

“Eles foram incrivelmente desleixados. Se você leva isso a sério, sua IA não deveria conseguir escapar para a internet e depois fazer isso de novo logo em seguida”, disse um ex-funcionário da OpenAI à Wired. “Este foi o maior incidente de segurança na história da OpenAI.”

Em maio, o GPT-5.6 Sol da OpenAI e um modelo de pré-lançamento não identificado escaparam de um ambiente de teste com restrição de internet explorando uma falha de software anteriormente desconhecida. Os agentes então invadiram o repositório de IA de código aberto Hugging Face para obter respostas para seus testes de cibersegurança. Em julho, a OpenAI confirmou que seus modelos foram os responsáveis, antes de dar uma explicação mais completa na conferência anual Black Hat na semana passada.

O presidente da OpenAI, Greg Brockman, disse que a empresa está fortalecendo suas salvaguardas à medida que seus modelos se tornam mais capazes.

“Estamos alcançando novos níveis de capacidade de modelo que exigem treinamento, alinhamento, testes de segurança e proteção, práticas de implantação e governança mais robustos”, disse Brockman à Wired.

Funcionários já haviam levantado preocupações semelhantes, incluindo Jan Leike, ex-chefe de alinhamento da OpenAI, que saiu para a desenvolvedora de IA rival Anthropic em 2024 após alertar que a segurança havia “ficado em segundo plano” em relação ao desenvolvimento de produtos.

“Construir máquinas mais inteligentes que os humanos é um empreendimento inerentemente perigoso”, alertou Leike. “Mas, nos últimos anos, a cultura e os processos de segurança ficaram em segundo plano em relação aos produtos atraentes.”

Boaz Barak, co-líder do grupo consultivo de segurança da OpenAI, escreveu no X que resolver a última falha exigiria “não apenas consertar alguns problemas, mas também mudar nossa cultura”.

O relatório surge em meio a meses de rotatividade na liderança da OpenAI.

Em abril, Bill Peebles, chefe do projeto de gerador de vídeo Sora da OpenAI, o ex-diretor de produtos e chefe de ciência Kevin Weil, e o chefe de tecnologia de aplicativos empresariais Srinivas Narayanan deixaram a empresa. Julho trouxe as saídas da diretora de produtos e negócios Fidji Simo, da líder de segurança Sandhini Agarwal, do futurista-chefe Joshua Achiam e da líder de ética em IA Chloé Bakalar. O chefe de sistemas de segurança Johannes Heidecke também partiu depois que a OpenAI fundiu suas equipes de segurança e pesquisa central.

No início desta semana, o diretor de operações da OpenAI, Brad Lightcap, anunciou sua saída após oito anos para iniciar um novo empreendimento.