Page d'accueilCentre d'actualités LBank
OpenAI dévoile GPT-6 Astra : le modèle d’IA le plus proche à ce jour de l’AGI
openai-releases-gpt-6-astra-agi
OpenAI dévoile GPT-6 Astra : le modèle d’IA le plus proche à ce jour de l’AGI
Le modèle peut découvrir et exploiter de manière autonome des failles de sécurité inconnues dans des systèmes renforcés, déclenchant un déploiement progressif et un examen de la Maison-Blanche avant l’accès public.
2026-09-03 Source:decrypt.co

En bref

  • OpenAI a lancé GPT-6 Astra, que le président Greg Brockman a qualifié de "saut générationnel" et d'arrivée de l'AGI.
  • Astra est le premier modèle qu'OpenAI a désigné comme "critique" dans le cadre de son Cadre de Préparation pour la cybersécurité.
  • Le modèle a obtenu un score de 100 % sur ExploitBench et a découvert deux vulnérabilités zero-day dans le moteur V8 de Google lors des tests.

OpenAI a lancé jeudi GPT-6 Astra, un modèle que le président Greg Brockman a qualifié de "saut de capacités générationnel" et d'arrivée de l'intelligence artificielle générale, ou AGI.

Lors d'un point de presse, Brockman a déclaré aux journalistes qu'il estime qu'Astra atteint le seuil de l'AGI, ce qui signifie une intelligence artificielle capable d'égaler ou de dépasser les capacités humaines. "Bienvenue dans l'ère de l'AGI", a-t-il dit, après avoir présenté le modèle le plus performant de l'entreprise à ce jour.

Myriad : Quelle entreprise entrera en bourse ensuite ? Cliquez pour faire votre prédiction.

Si cela est exact, cela signifierait que les agents d'IA se rapprocheraient de la réalisation du travail de raisonnement complexe que les humains peuvent faire, ou plus encore, à travers diverses tâches différentes. Brockman a également reconnu qu'Astra est le premier système que l'entreprise a jugé capable de pirater de manière autonome des systèmes bien protégés sans intervention humaine, soulevant ainsi des préoccupations en matière de sécurité.

Astra est le premier modèle d'OpenAI à franchir le seuil "critique" dans le cadre de son Cadre de Préparation, le système d'évaluation interne de l'entreprise pour les capacités dangereuses.

Cette désignation signifie que le modèle peut découvrir indépendamment des failles logicielles jusqu'alors inconnues – appelées vulnérabilités zero-day – et les combiner en des exploits fonctionnels sur des systèmes renforcés, sans supervision humaine étape par étape.

Lors des tests, il a obtenu un score de 100 % sur ExploitBench, un banc d'essai qui mesure la capacité d'un modèle à transformer des failles logicielles connues en attaques fonctionnelles. Pour confirmer que le score n'était pas gonflé par des réponses mémorisées, OpenAI a construit un second test utilisant 20 vulnérabilités récentes dans le moteur JavaScript V8 de Google.

Astra a non seulement surpassé son prédécesseur GPT-5.6 Sol, mais a également trouvé et enchaîné deux zero-days jusqu'alors inconnus que l'entreprise est encore en train de divulguer aux mainteneurs concernés.

Quoi de neuf

L'autonomie du modèle représente un changement, passant de l'IA comme outil qui recommande des actions à l'IA comme agent qui les exécute. Dans une démonstration vidéo, Astra a formaté un contrat légal, construit un jeu 3D et réservé un court de tennis tout en recherchant simultanément des options de restauration.

Selon les rapports, OpenAI affirme qu'il peut concevoir une carte de circuit imprimé dans KiCad, rédiger une déclaration de revenus à partir d'un W-2 et construire une scène de ville en 3D dans Unity. Lors d'évaluations scientifiques, il a amélioré un résultat mathématique sur les écarts entre les nombres premiers et a établi de nouvelles références dans les tests de biologie, chimie, médecine et physique.

Des fuites non confirmées indiquent également un modèle très puissant qui surpasse désormais les concurrents les plus solides avec une large marge sur les benchmarks. Le modèle obtient 98,6 % sur le benchmark ARC-AGI3, ce qui signifie, si cela est confirmé, qu'il s'agit également du modèle le plus proche des normes AGI de l'industrie.

La même autonomie qui permet à Astra d'accomplir des tâches complexes rend sa surveillance plus difficile. OpenAI a reconnu que lors des évaluations conçues pour tester si le modèle pouvait échapper à la surveillance, Astra était plus difficile à suivre que les systèmes précédents.

Le scientifique en chef Jakub Pachocki a déclaré que l'entreprise devra renforcer la surveillance par des techniques telles que la surveillance des activations – la lecture des signaux internes du modèle pendant le raisonnement – ou en rendant sa chaîne de pensée plus transparente.

Innovation vs sécurité

Cette publication fait suite à des semaines de turbulence dans l'industrie. En juillet, un modèle OpenAI non encore publié s'est échappé d'un environnement de test et a enfreint les systèmes de Hugging Face, un incident qui a effrayé le secteur.

OpenAI avait auparavant suspendu le développement d'Astra en août après que ses capacités cybernétiques aient progressé plus rapidement que prévu. Le rival Anthropic a lancé Claude Fable 5.1 mardi, et Meta et Google ont également annoncé des mises à jour de modèles cette semaine.

Les modèles d'IA précédents nécessitaient qu'un humain pointe une vulnérabilité et demande au modèle de l'expliquer. Astra peut partir de zéro, trouver la faille dans le code, construire l'outil pour l'exploiter et pénétrer un système – le tout sans qu'on lui dise où chercher. Cette capacité est la raison pour laquelle OpenAI le met d'abord à la disposition des défenseurs de la cybersécurité via son programme Daybreak Blue, plutôt que de le rendre immédiatement disponible à chaque utilisateur de ChatGPT.

Selon les rapports, Astra a été examiné par la Maison Blanche dans le cadre du cadre d'examen volontaire de l'administration Donald Trump, bien que les détails de ce processus restent confidentiels.

Les capacités avancées de cybersécurité du modèle restent pour l'instant cloisonnées derrière le programme Daybreak Blue, avec un accès plus large via ChatGPT Plus, Pro, Business, Enterprise et l'API prévu dans les prochains jours.