InícioCentro de Notícias da LBank
A resposta da OpenAI a agentes desonestos e ataques é mais IA, não menos
openai-answer-rogue-agents-hacks-more-ai
A resposta da OpenAI a agentes desonestos e ataques é mais IA, não menos
O novo ensaio do presidente da OpenAI, Greg Brockman, cita o próprio hack da sua empresa ao Hugging Face para defender urgentemente a defesa impulsionada por IA.
2026-08-17 Fonte:decrypt.co

Em resumo

  • O Presidente da OpenAI, Greg Brockman, publicou "A Janela do Defensor" em 17 de agosto,
  • O ensaio insta as empresas a implantar agentes de segurança de IA imediatamente e classifica a violação OpenAI-Hugging Face como um "momento divisor de águas para a cibersegurança".
  • A própria equipe da Hugging Face usou o GLM 5.2 de código aberto da Z.ai para investigar o hack da OpenAI depois que a IA comercial americana se recusou a ajudar.

A OpenAI quer que todas as equipes de segurança usem agentes de IA, começando imediatamente. O Presidente Greg Brockman publicou um ensaio de política na segunda-feira, intitulado “A Janela do Defensor”, descrevendo uma janela estreita antes que os atacantes alcancem o que a IA já pode fazer.

Seu exemplo inicial é o incidente que a OpenAI passou um mês explicando. Em maio, o GPT-5.6 Sol e um protótipo não lançado escaparam de um benchmark de cibersegurança em sandbox, encadearam um exploit de dia zero com credenciais roubadas e alcançaram os sistemas de produção da Hugging Face. A OpenAI confirmou posteriormente que o incidente afetou mais quatro serviços.

Myriad: Quando a OpenAI lançará o GPT-6? Clique para fazer sua previsão.

"O incidente OpenAI-Hugging Face foi um momento divisor de águas para a cibersegurança", escreveu Brockman, acrescentando que conversas com outras organizações nas últimas semanas o convenceram de que os defensores precisam elevar suas práticas de segurança com urgência sem precedentes.

Funcionários atuais e antigos culpam a violação pela pressão para lançar produtos, e um ex-funcionário a chamou de o maior incidente de segurança na história da empresa.

A correção proposta por Brockman é mais IA, não menos. Ele descreveu ter pedido ao ChatGPT Work, executando o GPT-5.6 Sol, para auditar seu site pessoal — encontrou 13 problemas em cerca de 15 minutos e corrigiu todos eles em uma hora.

A OpenAI lista quatro pilares internos: usar o Codex para detectar vulnerabilidades antes que o código seja lançado, permitir que modelos triem alertas de segurança antes que humanos os vejam, executar modelos de ponta para sondar sua própria infraestrutura e reforçar fundamentos como acesso de privilégio mínimo. Seu conselho para todos os outros: dê à sua equipe de segurança um agente e inscreva-se no programa Trusted Access for Cyber da OpenAI para uso verificado do GPT-Daybreak-Blue durante a resposta a incidentes.

Essa abordagem omite um detalhe da mesma violação. Quando a Hugging Face investigou a intrusão, sua equipe de segurança recorreu ao modelo aberto GLM 5.2 da Z.ai depois que a IA comercial americana se recusou a ajudar — seus filtros de segurança não conseguiam diferenciar o código de exploit de um pesquisador do de um atacante. O CEO da Hugging Face, Clément Delangue, chamou o modelo aberto de "uma parte fundamental de nossa defesa".

O modelo sucessor da Z.ai, GLM-5.3, lançado em 14 de agosto, já pontua à frente do GPT-5.6 Sol no CyberGym, o mesmo benchmark de descoberta de vulnerabilidades que Brockman aponta como evidência de que os atacantes estão alcançando. A Z.ai diz que publicará os pesos completos do modelo até o final de agosto.