
Há uma semana, o GPT-6 Astra estava reconstruindo Manhattan rua por rua dentro de um motor de jogo, impressionando os usuários com suas capacidades. Esta semana, a mesma multidão está publicando capturas de tela, questionando a OpenAI sobre o que aconteceu com seu modelo.
"Astra parece significativamente mais burro para mim hoje", publicou no X o popular desenvolvedor pseudônimo synthwavedd. "Era apenas uma questão de tempo para a Lobotomia Pós-Lançamento. Que pena."
É um refrão familiar, com usuários de IA acostumados a ver seus chatbots e agentes favoritos de repente "nerfados". Na maioria das vezes, há explicações razoáveis para a queda percebida no desempenho desses modelos. Mas quando pessoas suficientes começam a dizer a mesma coisa ao mesmo tempo, vale a pena examinar o que está acontecendo. E as redes sociais, no momento, estão repletas de exemplos de usuários rapidamente se desiludindo com o GPT-6 Astra.
O desenvolvedor Pranjal Paliwal, que anteriormente havia elogiado o modelo, voltou e realmente leu o código que o Astra havia escrito para ele. Ele não gostou do que encontrou.
"Não temos AGI", ele publicou. "Temos uma regressão."
fml, finally had a look at the code astra wrote.
I take my words back.We don't have AGI.
We have a regression.How can it be so smart and so dumb at the same time!
— Pranjal Paliwal (@betterclever) September 11, 2026
AGI, sigla para inteligência artificial geral, é o termo da indústria para uma máquina que pode fazer essencialmente tudo o que um humano pode fazer cognitivamente. O próprio presidente da OpenAI usou a palavra no lançamento do Astra. Uma semana depois, um de seus usuários a está usando para descrever o oposto.
As reclamações compartilham um formato semelhante. O desenvolvedor Pankaj Kumar listou os sintomas: respostas mais rápidas, pior qualidade e a suspeita de que a OpenAI "reduziu o valor de processamento". A fundadora Saba perguntou diretamente à OpenAI por que agora ela precisa "simplificar" para realizar tarefas.
"Valor de processamento" não é um termo oficial. Ninguém o definiu. Mas é um atalho que todos aqui entendem: a quantidade de esforço computacional que o modelo gasta pensando antes de responder, e a suspeita de que a OpenAI diminuiu silenciosamente esse valor assim que as demos de lançamento fizeram seu trabalho.
Algumas pessoas testaram corretamente. Salio e o pesquisador Md Ismail Sojal executaram o mesmo prompt no Astra do dia do lançamento e na versão atual, e ambos obtiveram resultados piores com o atual.
Today’s GPT-6 Astra output looks worse.
GPT-6 Astra at launch vs GPT-6 Astra today.- Tibo said they have compute
- Same prompt,Same settings.
- evan I ran the exact same prompt on GPT-6 Astra at launch and again today.
- The difference is bigger than I expected.…— Md Ismail Šojal 🕷️ (@0x0SojalSec) September 11, 2026
Outros estão simplesmente voltando. Dax Raad, que desenvolve a ferramenta de codificação Opencode, disse que sua equipe voltou ao predecessor do Astra, GPT-5.6 Sol, porque o gasto dobrou para desvantagens que não valiam a pena. O usuário do ChatGPT Mustafa Sahinli expressou isso de forma mais direta: Astra agora o faz sentir como o Claude Opus 4.6 "depois de 1 semana de lançamento", uma alusão à própria reação negativa pós-lançamento da Anthropic.
Nem todos pensam que a OpenAI "nerfou" propositalmente seu modelo mais recente, no entanto. O usuário pseudônimo Antikythera publicou a refutação mais detalhada no grupo, argumentando que a linha do tempo está invertida.
"É tão burro quanto era no lançamento", escreveu Antikythera. "O modelo é bom, mas tem muitos problemas. É preguiçoso. Escreve como um viciado em listas... as pessoas estavam super empolgadas na semana de lançamento, agora tiveram tempo de testá-lo e ver seus erros."
Em outras palavras: nada mudou. Você apenas parou de ser deslumbrado o tempo suficiente para perceber que o modelo sempre foi um pouco "viciado em listas".
O fundador da T3Chat, Theo, tem uma ideia um tanto semelhante: Astra é, na verdade, mais inconsistente que Claude Fable, então pode produzir código excelente ou completamente estúpido às vezes. O que parece estar acontecendo é uma onda de usuários publicando os resultados ruins com mais frequência agora que a lua de mel acabou.
GPT-6 Astra has done incredible things I never thought a model could do. It has also done some of the stupidest things I've ever seen a model do.
Generally speaking, Fable 5.1 just does what I ask. pic.twitter.com/X2UwI7tDnD
— Theo - t3.gg (@theo) September 8, 2026
Isso também não é novidade. O último modelo principal da OpenAI, GPT-5.6 Sol, passou pelo mesmo ciclo em julho, quando os usuários relataram que seu modo de raciocínio superior havia se tornado superficial da noite para o dia. O executivo da OpenAI, Tibo Sottiaux, negou enfraquecê-lo deliberadamente, ao mesmo tempo em que confirmou que a empresa estava experimentando o esforço de raciocínio, a configuração que controla quantos passos um modelo "pensa" antes de responder.
Uma resposta resumiu a piada recorrente: laboratórios fechados lançam um modelo, e ele contrai "algum tipo de doença alguns dias depois e de repente fica[m] mais burro[s]". Outro ofereceu a teoria cínica em uma única linha: "Eles provavelmente são quantizados para não queimar tanto dinheiro das empresas."
this time they were dumb on arrival though. I gave Astra exactly one task, which it failed miserably, 5.6 SOL on xHigh then did the cleanup...
— Physicist 🏖️ 💻 (@heisenberg_btc) September 11, 2026
Quantizar um modelo significa reduzir a precisão de sua matemática interna para cortar custos, muitas vezes à custa da precisão. A OpenAI nunca confirmou ter feito isso propositalmente com um modelo lançado.
A OpenAI ainda não emitiu uma declaração no estilo Sol sobre o Astra. O modelo permanece como o primeiro da empresa a cruzar o que ela chama de limiar crítico para risco de cibersegurança, o que significa que ele pode encontrar e encadear vulnerabilidades de software desconhecidas sem orientação humana, uma capacidade restrita a defensores aprovados sob o programa Daybreak da OpenAI.
Mais burro ou não, ainda custa US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída, 2,5 vezes o que o Sol cobrava no lançamento.








