
Elon Musk a fixé un objectif pour début août concernant Grok 4.6 et a dévoilé des plans pour un modèle Grok 4.7 plus grand, alors que SpaceXAI intensifie sa concurrence avec OpenAI, Anthropic et Moonshot AI en Chine.
Musk a divulgué le calendrier dans un message du 28 juillet sur X, indiquant que Grok 4.6 serait lancé "autour du 7 août". Il l'a décrit comme un modèle de 1,5 billion de paramètres avec un affinage supervisé et un apprentissage par renforcement plus robustes.
L'affinage supervisé entraîne un modèle sur des exemples sélectionnés pour améliorer la qualité de ses réponses. L'apprentissage par renforcement utilise des signaux de rétroaction et de récompense pour affiner la manière dont un modèle gère les tâches et suit les instructions.
Musk a également déclaré que Grok 4.7 suivrait "quelques semaines plus tard" en tant que modèle de 2,1 billions de paramètres. Cependant, il n'a pas fourni de date de lancement exacte ni divulgué de détails sur les prix et la disponibilité pour aucune des deux versions.
« Ce sera meilleur que le 4.6 à tous égards, sauf légèrement plus lent à servir, bien qu'avec une efficacité des jetons encore meilleure », a déclaré Musk à propos de Grok 4.7.
Ces deux dates restent des objectifs plutôt que des rendez-vous de sortie confirmés. Les calendriers de développement de modèles peuvent changer pendant la formation, les tests et le déploiement.
SpaceXAI a introduit Grok 4.5 plus tôt en juillet comme un modèle conçu pour le codage, les tâches basées sur des agents et le travail de connaissance. L'entreprise facture actuellement 2 $ par million de jetons d'entrée et 6 $ par million de jetons de sortie.
Musk a annoncé les deux modèles suivants en réponse à une évaluation du PDG de Vercel, Guillermo Rauch, qui a décrit Grok 4.5 comme le modèle de cybersécurité le plus performant par rapport à son prix lors des derniers tests de Vercel.
Selon le message de Rauch, Grok 4.5 était 10 fois moins cher que GPT-5.6 Sol d'OpenAI, 5,7 fois moins cher qu'Opus 5 d'Anthropic, et 2,2 fois moins cher que Kimi K3 de Moonshot, tout en offrant des performances proches de celles de Kimi.
Rauch a tout de même classé Sol comme le principal modèle de pointe, devant Opus 5. Ses conclusions reflètent les méthodes de test de Vercel et n'établissent pas un classement universel pour toutes les charges de travail d'IA.
SpaceXAI n'a pas précisé si Grok 4.6 et Grok 4.7 conserveraient la tarification de Grok 4.5. La vitesse du service, l'utilisation des jetons et les coûts d'API détermineront si les nouveaux modèles maintiendront le même avantage en termes de rapport prix-performance.
Les améliorations prévues de Grok arrivent alors que les développeurs chinois réduisent l'écart avec les principales entreprises d'IA américaines. Moonshot AI a publié l'intégralité des poids de Kimi K3 le 27 juillet, permettant aux développeurs de télécharger, modifier et opérer le modèle sur leur propre infrastructure.
Kimi K3 dispose de 2,8 billions de paramètres, de capacités visuelles natives et d'une fenêtre contextuelle d'un million de jetons. Son échelle et sa structure à poids ouverts ont exercé une pression accrue sur les entreprises américaines qui distribuent principalement leurs modèles les plus avancés via des plateformes fermées et des API payantes.
SpaceXAI, OpenAI et Anthropic sont également en concurrence sur le codage, la cybersécurité, le raisonnement et le coût nécessaire pour accomplir chaque tâche. L'architecture plus grande de Grok 4.7 pourrait améliorer ses capacités, mais Musk a reconnu qu'il serait plus lent à servir que Grok 4.6.
Le nombre de paramètres ne détermine pas à lui seul la qualité du modèle. Les données d'entraînement, l'architecture, les méthodes de post-entraînement, les systèmes d'inférence et l'efficacité des jetons peuvent tous affecter les performances.
OpenAI et Anthropic ont déjà accepté de fournir aux fonctionnaires américains un accès anticipé à des modèles de pointe non publiés pour des tests de sécurité. Ces accords ont servi de base à un cadre plus large d'examen fédéral volontaire qui couvre désormais d'autres grands développeurs, notamment SpaceXAI, Google DeepMind et Microsoft.
Le président Donald Trump a officialisé ce cadre par un décret exécutif en juin. Les entreprises participantes peuvent fournir les modèles concernés au gouvernement fédéral jusqu'à 30 jours avant de les publier à des partenaires de confiance. Le décret stipule que ces examens ne créent pas de système obligatoire de licence ou de pré-autorisation.
Cependant, l'industrie reste divisée sur la manière dont Washington devrait gérer les modèles à poids ouverts. Nvidia, Microsoft, Meta, OpenAI, Palantir et d'autres organisations ont mis en garde les décideurs politiques américains contre des restrictions généralisées dans une lettre ouverte du 24 juillet. Elles ont fait valoir que les modèles ouverts favorisent la concurrence, réduisent les coûts de déploiement et permettent aux développeurs d'exécuter et de modifier les systèmes d'IA sur leur propre infrastructure.
Le débat s'est intensifié après la publication du Kimi K3 de Moonshot AI, doté de 2,8 billions de paramètres. Des fonctionnaires de l'administration Trump ont accusé Moonshot d'avoir utilisé les sorties du modèle Fable d'Anthropic pour entraîner Kimi K3 par le biais d'une distillation à grande échelle. Michael Kratsios, conseiller technologique de la Maison Blanche, a décrit cette pratique présumée comme une tentative d'obtenir une technologie américaine propriétaire, tandis que le secrétaire au Trésor Scott Bessent a déclaré que l'administration envisageait des sanctions et l'inscription de Moonshot sur une liste noire commerciale.
Moonshot n'a pas publiquement accepté ces allégations. Le différend a néanmoins placé Kimi K3 au centre d'une lutte politique plus large sur la question de savoir si Washington devrait cibler des risques spécifiques en matière de sécurité et de propriété intellectuelle ou restreindre plus largement l'accès aux modèles chinois à poids ouverts. Grok 4.6 et Grok 4.7 entreront sur ce marché alors que les développeurs américains sont sous pression pour améliorer les performances tout en répondant aux attentes fédérales émergentes en matière de sécurité.








