Page d'accueilCentre d'actualités LBank
xAI lance Grok 4.7. C’est plus grand, mais en retard à la fête de la frontière de l’IA
xai-launches-grok-4-7
xAI lance Grok 4.7. C’est plus grand, mais en retard à la fête de la frontière de l’IA
xAI affirme que le nouveau modèle constitue une « amélioration notable » par rapport à Grok 4.6, au même prix. Les benchmarks indiquent qu’il reste en deuxième position.
2026-09-21 Source:decrypt.co

En bref

  • xAI a lancé Grok 4.7 lundi, après au moins cinq reports depuis fin juillet.
  • Le modèle s’est classé derrière Claude Fable 5.1 sur GDPval et AA-Briefcase, et derrière GPT-6 Astra sur EEBench, un benchmark d’ingénierie électrique.
  • Grok 4.7 est disponible immédiatement dans l’application Grok, Cursor, Grok Build et l’API xAI, avec 2,1 billions de paramètres et un entraînement complémentaire sur des données d’ingénierie de SpaceX.

La société xAI d’Elon Musk a lancé Grok 4.7 lundi après-midi, son meilleur modèle à ce jour, le qualifiant de « nette amélioration par rapport à Grok 4.6 au même prix et à la même vitesse ».

Cette sortie intervient après plusieurs retards apparents. Musk a repoussé l’échéance au moins cinq fois depuis fin juillet : « dans quatre semaines », puis « dans quelques semaines », puis « 3 à 4 semaines », puis « 10 jours » le 1er septembre, puis « a besoin de quelques jours de plus pour mijoter » le 11 septembre.

Myriad : Combien vaudra Elon Musk ? Cliquez pour faire votre prédiction.

xAI affirme que le modèle passe plus de temps à résoudre les problèmes difficiles et revérifie ses propres réponses plus souvent que Grok 4.6, tout en intégrant ce que l’entreprise présente comme ses garde-fous de sécurité les plus robustes à ce jour.

Musk a ensuite publié sur X, qualifiant Grok 4.7 de « solide combinaison d’intelligence, de vitesse et de faible coût ». Il n’y a cette fois aucune liste d’attente : le modèle est déjà en ligne dans l’application Grok, Cursor, Grok Build et l’API xAI.

Grok 4.7 est arrivé.

Il s’agit d’une nette amélioration par rapport à Grok 4.6 au même prix et à la même vitesse. pic.twitter.com/H3OTBbXyvO

— SpaceXAI (@SpaceXAI) 21 septembre 2026

Grok 4.7 embarque 2,1 billions de paramètres, soit une hausse de 40 % par rapport aux 1,5 billion de Grok 4.6, lui-même une version affinée de Grok 4.5. Les coûts s’élèvent à 2 dollars par million de tokens en entrée et 6 dollars par million de tokens en sortie. Les paramètres sont les réglages internes qu’un modèle ajuste durant l’entraînement, et un plus grand nombre signifie généralement une capacité accrue à apprendre des motifs, tandis que les tokens constituent l’unité de base d’information qu’un modèle d’IA peut traiter ou générer.

xAI a également intégré des données d’entraînement complémentaires issues de SpaceX, la société spatiale de Musk : télémétrie des satellites Starlink, dossiers de fabrication et journaux de défaillances d’ingénierie. L’argument est celui d’un modèle capable de mieux raisonner sur le matériel et les systèmes physiques que n’importe quel modèle entraîné uniquement sur du texte provenant d’Internet.

Cela dit, les scores de benchmark racontent une histoire familière. GDPval mesure les performances d’un modèle sur des tâches réelles de travail intellectuel à valeur économique — mémos juridiques, feuilles de calcul, présentations — à partir d’exercices validés par des professionnels en activité dans chaque domaine, puis attribue un score Elo, le même système de classement en face-à-face que celui utilisé aux échecs.

Grok 4.7 a atteint 1695 sur GDPval. Claude Fable 5.1 domine le classement avec 1735.

AA-Briefcase, conçu par Artificial Analysis, teste un travail de bureau sur plusieurs heures en enchaînant recherche, analyse et production de documents au sein d’une seule longue tâche, également notée sur l’échelle Elo. Grok 4.7 a affiché 1657 contre 1678 pour Fable 5.1. Même résultat, test différent.

CursorBench 4.0, le benchmark de Cursor pour des tâches réelles de codage dans son éditeur, met en regard la précision avec le coût et le nombre de tokens consommés par chaque tâche. Grok 4.7 se situe au milieu : plus coûteux par tâche que GPT-6 Astra, successeur de GPT-5.6 Sol, et que Claude Sonnet 5, mais toujours en retrait par rapport à Fable 5.1, qui l’emporte à tous les niveaux de prix sur le graphique.

Ce n’est pas un schéma nouveau pour xAI. Grok 4.5 a été lancé en juillet avec le plus grand cluster d’entraînement du secteur et des scores de troisième place derrière Claude et les modèles d’OpenAI. Avant lui, Grok 4.20 sacrifiait la fiabilité au profit de la vitesse et de la personnalité. Grok 4.6 était lui aussi en retrait du peloton de tête sur l’autonomie en codage.

Rien de tout cela ne fait de Grok 4.7 un mauvais produit pour les millions de personnes qui interagissent avec lui via X, l’application autonome ou le tableau de bord de leur Tesla. Cela signifie que le modèle le plus susceptible de répondre à vos questions, ou d’alimenter l’assistant vocal de votre voiture, fonctionne sur un système que les propres benchmarks de son créateur placent un cran en dessous du sommet.

Cet écart explique pourquoi, pour la plupart des utilisateurs, le prix compte davantage que la position au classement. xAI a régulièrement cassé les prix d’Anthropic et d’OpenAI en coût par token, tout en restant derrière eux sur les capacités brutes, en pariant que « suffisamment bon, bon marché et omniprésent » l’emportera sur « le meilleur, mais plus cher » pour l’essentiel des usages quotidiens.

Musk avait déjà revu les attentes à la baisse quelques jours avant le lancement, écrivant que Grok 4.7 devrait se situer « à peu près au niveau » de Claude Opus 5.0 d’Anthropic, et non du plus récent Opus 5.1, tandis que les performances multimodales nécessitent encore du travail.

Dans ce même message, il a esquissé les trois prochains modèles : Grok 4.8 comme une avancée significative, Grok 4.9 dans la « classe Astra/Fable », et Grok 5 comme possible leader de frontière. Ces mises à niveau n’ont pas encore de date de sortie. « Nous verrons », a-t-il écrit.