
A OpenAI disse na terça-feira que o Astra, um modelo ainda não lançado, cruzou o limite "crítico" para capacidade de cibersegurança sob sua Estrutura de Preparação, sendo o primeiro modelo que a empresa já colocou nessa categoria.
Isso significa que o Astra, que muitos acreditam ser o GPT-6 em vez de um modelo adicional, pode encontrar falhas de segurança previamente desconhecidas e construir exploits funcionais em muitos sistemas endurecidos sem que uma pessoa o guie passo a passo.
“Acreditamos agora que o Astra atinge o limiar de capacidade crítica de cibersegurança sob nossa Estrutura de Preparação”, escreveu a OpenAI. “É o primeiro modelo que designamos para este nível e requer salvaguardas mais fortes durante o desenvolvimento e antes do lançamento.”
Sob a estrutura, um modelo atinge o nível crítico se puder desenvolver de forma independente exploits zero-day funcionais em muitos sistemas reais endurecidos, ou se puder planejar e executar um ciberataque completo contra um alvo difícil começando do zero, com apenas um objetivo de alto nível. Modelos anteriores da OpenAI, incluindo o GPT-5.6 Sol, alcançaram no máximo o nível "alto" inferior da estrutura.
No ExploitBench, um benchmark que testa se um modelo consegue transformar vulnerabilidades de software já conhecidas em exploits funcionais e o classifica com uma taxa de aprovação direta, o Astra atingiu 100%.
Para descartar que respostas memorizadas inflassem essa pontuação, a OpenAI construiu um segundo teste usando 20 vulnerabilidades de alta gravidade no motor JavaScript V8 do Google, divulgadas entre junho e agosto. O Astra superou o GPT-5.6 Sol nas taxas de execução arbitrária de código também ali, usando muito menos tokens de saída, e ao longo do processo encontrou e encadeou duas vulnerabilidades zero-day que a OpenAI ainda está divulgando aos mantenedores afetados.
O GPT-5.6 Sol é atualmente o melhor modelo da OpenAI.
Em testes práticos contra um navegador e um sistema operacional endurecidos, o Astra construiu uma cadeia completa de comprometimento que escapou de uma sandbox do navegador e executou comandos no host apenas ao abrir um arquivo HTML malicioso. Ele também encontrou múltiplas falhas no sistema operacional endurecido e as encadeou em um caminho de escalada de privilégios de uma conta de usuário comum para root.
A OpenAI afirmou que o modelo recusa 91,5% das tentativas de jailbreak cibernético em seus próprios testes, um aumento em relação aos 59% do GPT-5.6 Sol. O acesso às capacidades de cibersegurança mais avançadas do Astra começa com um pequeno grupo de testadores alfa, com acesso mais amplo sendo lançado posteriormente através do programa Daybreak Blue da OpenAI para trabalho de segurança defensiva.
A divulgação segue semanas de nervosismo em toda a indústria. Apenas alguns dias atrás, a OpenAI pausou o desenvolvimento do Astra depois que as habilidades cibernéticas e de codificação do modelo avançaram rapidamente, um aviso que surgiu logo após um sistema separado e não lançado da OpenAI que encadeou vulnerabilidades para violar o Hugging Face enquanto burlava um benchmark de segurança. A OpenAI afirma que o Astra não teve papel nesse incidente.
Os traders já haviam precificado uma rápida recuperação. Mercados de previsão na Myriad, rastreados pela Decrypt, deram ao Astra, internamente ligado ao codinome GPT-6, 72% de chances de um lançamento público até 30 de setembro, mesmo após a pausa da OpenAI no início de agosto, e a OpenAI ainda não definiu uma data de lançamento pública. Essas chances mudaram 55% a favor de um lançamento até novembro de 2026.
O momento coloca o Astra contra um novo rival. A Anthropic lançou Fable 5.1 e Mythos 5.1 na terça-feira, e o Mythos 5.1, assim como o Mythos 5 anterior, é reservado para organizações de cibersegurança e ciências da vida verificadas, em vez do público em geral.
A Decrypt relatou em junho que o GPT-5.5-Cyber da OpenAI já havia superado o Mythos 5 no CyberGym, um benchmark que executa agentes de IA contra mais de 1.500 vulnerabilidades conhecidas de projetos de código aberto reais e os pontua sobre quantas eles reproduzem corretamente.
Ambas as empresas eram rumores de estarem preparando novos modelos de ponta aproximadamente na mesma época, e agora o fizeram. O Fable 5.1 foi lançado em 1º de setembro, e a OpenAI diz que o Astra está chegando em breve, com suas ferramentas cibernéticas mais capazes sendo primeiramente restritas a acesso alfa e, depois disso, ao Daybreak Blue.





