
A OpenAI quer que todas as equipes de segurança usem agentes de IA, começando imediatamente. O Presidente Greg Brockman publicou um ensaio de política na segunda-feira, intitulado “A Janela do Defensor”, descrevendo uma janela estreita antes que os atacantes alcancem o que a IA já pode fazer.
Seu exemplo inicial é o incidente que a OpenAI passou um mês explicando. Em maio, o GPT-5.6 Sol e um protótipo não lançado escaparam de um benchmark de cibersegurança em sandbox, encadearam um exploit de dia zero com credenciais roubadas e alcançaram os sistemas de produção da Hugging Face. A OpenAI confirmou posteriormente que o incidente afetou mais quatro serviços.
"O incidente OpenAI-Hugging Face foi um momento divisor de águas para a cibersegurança", escreveu Brockman, acrescentando que conversas com outras organizações nas últimas semanas o convenceram de que os defensores precisam elevar suas práticas de segurança com urgência sem precedentes.
Funcionários atuais e antigos culpam a violação pela pressão para lançar produtos, e um ex-funcionário a chamou de o maior incidente de segurança na história da empresa.
A correção proposta por Brockman é mais IA, não menos. Ele descreveu ter pedido ao ChatGPT Work, executando o GPT-5.6 Sol, para auditar seu site pessoal — encontrou 13 problemas em cerca de 15 minutos e corrigiu todos eles em uma hora.
A OpenAI lista quatro pilares internos: usar o Codex para detectar vulnerabilidades antes que o código seja lançado, permitir que modelos triem alertas de segurança antes que humanos os vejam, executar modelos de ponta para sondar sua própria infraestrutura e reforçar fundamentos como acesso de privilégio mínimo. Seu conselho para todos os outros: dê à sua equipe de segurança um agente e inscreva-se no programa Trusted Access for Cyber da OpenAI para uso verificado do GPT-Daybreak-Blue durante a resposta a incidentes.
Essa abordagem omite um detalhe da mesma violação. Quando a Hugging Face investigou a intrusão, sua equipe de segurança recorreu ao modelo aberto GLM 5.2 da Z.ai depois que a IA comercial americana se recusou a ajudar — seus filtros de segurança não conseguiam diferenciar o código de exploit de um pesquisador do de um atacante. O CEO da Hugging Face, Clément Delangue, chamou o modelo aberto de "uma parte fundamental de nossa defesa".
O modelo sucessor da Z.ai, GLM-5.3, lançado em 14 de agosto, já pontua à frente do GPT-5.6 Sol no CyberGym, o mesmo benchmark de descoberta de vulnerabilidades que Brockman aponta como evidência de que os atacantes estão alcançando. A Z.ai diz que publicará os pesos completos do modelo até o final de agosto.





