Page d'accueilCentre d'actualités LBank
Les utilisateurs de GPT-6 Astra affirment que le dernier modèle d’OpenAI est devenu moins intelligent. Cela s’est déjà produit auparavant.
gpt-6-astra-openai-model-dumber-nerfed
Les utilisateurs de GPT-6 Astra affirment que le dernier modèle d’OpenAI est devenu moins intelligent. Cela s’est déjà produit auparavant.
Une semaine après son lancement, les plaintes affluent de la part des utilisateurs qui affirment que GPT-6 Astra a été nerfé. Le dernier modèle d’OpenAI a connu le même cycle en juillet.
2026-09-12 Source:decrypt.co

En bref

  • Les plaintes concernant le "nerf" d'Astra inondent X une semaine seulement après son lancement.
  • Auparavant, les utilisateurs avaient déjà constaté un problème de qualité d'écriture au moment du lancement.
  • Le dernier modèle d'OpenAI, Sol, a connu la même réaction négative en juillet.

Il y a une semaine, GPT-6 Astra reconstruisait Manhattan rue par rue à l'intérieur d'un moteur de jeu, époustouflant les utilisateurs avec ses capacités. Cette semaine, la même foule publie des captures d'écran pour demander à OpenAI ce qui est arrivé à leur modèle.

"Astra me semble significativement plus bête aujourd'hui", a posté sur X le populaire développeur pseudonyme synthwavedd. "Ce n'était qu'une question de temps avant la lobotomie post-lancement. Dommage."

Myriad : Jusqu'où ira l'action Nvidia ? Cliquez pour faire votre prédiction.

C'est un refrain familier, les utilisateurs d'IA étant habitués à ce que leurs chatbots et agents préférés donnent soudainement l'impression d'avoir été "nerfés". La plupart du temps, il existe des explications raisonnables à cette baisse de performance perçue de ces modèles. Mais quand suffisamment de personnes commencent à dire la même chose au même moment, il vaut la peine d'examiner ce qui se passe. Et les médias sociaux sont actuellement remplis d'exemples d'utilisateurs qui se lassent rapidement de GPT-6 Astra.

Le développeur Pranjal Paliwal, qui avait auparavant loué le modèle, est retourné lire le code qu'Astra lui avait écrit. Il n'a pas aimé ce qu'il a trouvé.

"Nous n'avons pas d'AGI", a-t-il posté. "Nous avons une régression."

fml, finally had a look at the code astra wrote.
I take my words back.

We don't have AGI.
We have a regression.

How can it be so smart and so dumb at the same time!

— Pranjal Paliwal (@betterclever) September 11, 2026

L'AGI, abréviation d'intelligence artificielle générale, est le terme de l'industrie pour une machine qui peut faire essentiellement tout ce qu'un humain peut faire cognitivement. Le propre président d'OpenAI a utilisé ce mot lors du lancement d'Astra. Une semaine plus tard, un de ses utilisateurs l'utilise pour décrire l'inverse.

Les plaintes partagent une forme similaire. Le développeur Pankaj Kumar a énuméré les symptômes : réponses plus rapides, qualité inférieure, et un soupçon qu'OpenAI a "réduit la valeur de jus". La fondatrice Saba a demandé directement à OpenAI pourquoi elle doit maintenant "simplifier" pour accomplir ses tâches.

La "valeur de jus" n'est pas un terme officiel. Personne ne l'a définie. Mais c'est un raccourci que tout le monde comprend ici : la quantité d'effort de calcul que le modèle dépense à réfléchir avant de répondre, et le soupçon qu'OpenAI a discrètement baissé ce réglage une fois que les démos de lancement avaient fait leur travail.

Certaines personnes l'ont testé correctement. Salio et le chercheur Md Ismail Sojal ont tous deux exécuté le même prompt sur Astra le jour du lancement et sur la version actuelle, et tous deux ont obtenu de moins bons résultats avec la version actuelle.

Today’s GPT-6 Astra output looks worse.
GPT-6 Astra at launch vs GPT-6 Astra today.

- Tibo said they have compute
- Same prompt,Same settings.
- evan I ran the exact same prompt on GPT-6 Astra at launch and again today.
- The difference is bigger than I expected.…

— Md Ismail Šojal 🕷️ (@0x0SojalSec) September 11, 2026

D'autres sont simplement en train de revenir en arrière. Dax Raad, qui développe l'outil de codage Opencode, a déclaré que son équipe était retournée au prédécesseur d'Astra, GPT-5.6 Sol, car la dépense avait doublé pour des inconvénients qui n'en valaient pas la peine. L'utilisateur de ChatGPT Mustafa Sahinli l'a dit plus crûment : Astra lui donne maintenant l'impression de Claude Opus 4.6 "après 1 semaine de sortie", un coup de griffe au propre contrecoup post-lancement d'Anthropic.

Cependant, tout le monde ne pense pas qu'OpenAI ait intentionnellement "nerfé" son dernier modèle. L'utilisateur pseudonyme Antikythera a publié la réfutation la plus détaillée, arguant que la chronologie est inversée.

"Il est aussi bête qu'il l'était au lancement", a écrit Antikythera. "Le modèle est bon, mais il a beaucoup de problèmes. Il est paresseux. Écrit comme un accro aux listes à puces... les gens étaient surexcités la semaine du lancement, maintenant ils ont eu le temps de le tester et de voir ses erreurs."

En d'autres termes : rien n'a changé. Vous avez juste cessé d'être ébloui assez longtemps pour remarquer que le modèle était toujours un peu un accro aux listes à puces.

Le fondateur de T3Chat, Theo, a une idée quelque peu similaire : Astra est en fait plus incohérent que Claude Fable, il peut donc produire du code exceptionnel ou carrément stupide par moments. Ce qui semble se passer est une vague d'utilisateurs qui publient plus fréquemment les résultats stupides maintenant que la lune de miel est terminée.

GPT-6 Astra has done incredible things I never thought a model could do. It has also done some of the stupidest things I've ever seen a model do.

Generally speaking, Fable 5.1 just does what I ask. pic.twitter.com/X2UwI7tDnD

— Theo - t3.gg (@theo) September 8, 2026

Ce n'est pas nouveau non plus. Le dernier fleuron d'OpenAI, GPT-5.6 Sol, a connu le même cycle en juillet, lorsque les utilisateurs ont signalé que son mode de raisonnement principal était devenu superficiel du jour au lendemain. Le dirigeant d'OpenAI, Tibo Sottiaux, a nié l'avoir délibérément affaibli, tout en confirmant que l'entreprise avait expérimenté l'effort de raisonnement, le paramètre qui contrôle le nombre d'étapes qu'un modèle "réfléchit" avant de répondre.

Une réponse a résumé la blague récurrente : les laboratoires fermés publient un modèle, il attrape "une sorte de maladie quelques jours plus tard et devient soudainement plus bête". Un autre a proposé la théorie du cynique en une seule ligne : "Ils sont probablement quantifiés pour ne pas brûler autant d'argent aux entreprises."

this time they were dumb on arrival though. I gave Astra exactly one task, which it failed miserably, 5.6 SOL on xHigh then did the cleanup...

— Physicist 🏖️ 💻 (@heisenberg_btc) September 11, 2026

Quantifier un modèle signifie réduire la précision de ses calculs internes pour réduire les coûts, souvent au détriment de l'exactitude. OpenAI n'a jamais confirmé avoir fait cela délibérément sur un modèle commercialisé.

OpenAI n'a pas encore publié de déclaration de type Sol concernant Astra. Le modèle reste le premier de l'entreprise à franchir ce qu'elle appelle le seuil critique de risque de cybersécurité, ce qui signifie qu'il peut trouver et enchaîner des vulnérabilités logicielles inconnues sans intervention humaine, une capacité réservée aux défenseurs agréés dans le cadre du programme Daybreak d'OpenAI.

Plus bête ou non, il coûte toujours 10 $ par million de tokens d'entrée et 50 $ par million de tokens de sortie, soit 2,5 fois le prix de Sol au lancement.