Page d'accueilCentre d'actualités LBank
OpenAI fait monter la température avec Jalapeño, sa première puce d'IA sur mesure
openai-broadcom-jalapeno-first-custom-ai-chip
OpenAI fait monter la température avec Jalapeño, sa première puce d'IA sur mesure
Construit avec Broadcom, l'accélérateur axé sur les LLM est la première étape de l'effort d'OpenAI pour concevoir le matériel derrière ChatGPT et au-delà.
2026-06-24 Source:decrypt.co

En bref

  • OpenAI et Broadcom ont dévoilé Jalapeño, la première puce d'inférence personnalisée du géant de l'IA.
  • OpenAI affirme que l'accélérateur a été conçu spécifiquement pour les grands modèles linguistiques.
  • Cette révélation fait suite à des mois de rapports indiquant qu'OpenAI développait des puces personnalisées pour réduire sa dépendance à l'égard de Nvidia.

OpenAI a dévoilé mercredi Jalapeño, sa première puce d'intelligence artificielle personnalisée, donnant un nom piquant à un projet qui pourrait transformer la manière dont l'entreprise alimente ChatGPT et ses futurs produits d'IA.

Développée avec Broadcom, la puce est conçue spécifiquement pour l'inférence des grands modèles linguistiques — le processus qui génère des réponses aux requêtes des utilisateurs — et marque la démarche la plus significative d'OpenAI à ce jour pour mieux contrôler la pile matérielle de ses modèles d'IA.

« Jalapeño fait partie de notre stratégie d'infrastructure à long terme et full-stack visant à rendre le calcul plus abondant, ce qui se traduira par une IA plus rapide, plus fiable, plus abordable pour les particuliers et les entreprises, et qui pourra être utilisée pour résoudre des problèmes plus importants », a déclaré Greg Brockman, président d'OpenAI, dans un communiqué. « En concevant une plus grande partie de la pile nous-mêmes, nous pouvons offrir plus d'intelligence avec une plus grande efficacité et continuer à pousser l'IA avancée vers un accès plus large. »

Contrairement à de nombreuses puces d'IA conçues pour gérer un large éventail de tâches informatiques, Jalapeño a été construite spécifiquement pour faire fonctionner les chatbots et d'autres systèmes d'IA alimentés par de grands modèles linguistiques. OpenAI a déclaré que les premières versions de la puce sont déjà testées dans ses laboratoires, y compris avec GPT-5.3-Codex-Spark. L'entreprise affirme que Jalapeño peut fournir plus de puissance de calcul tout en consommant moins d'énergie que les puces d'IA leaders actuelles, bien qu'elle n'ait pas encore publié de résultats de référence.

L'annonce confirme les rapports selon lesquels OpenAI construisait un programme de puces personnalisées. Plus tôt cette année, Reuters avait rapporté que l'entreprise prévoyait de lancer sa première puce d'IA déployée en interne, cherchant à réduire sa dépendance vis-à-vis du matériel Nvidia. Les ambitions d'OpenAI en matière de puces ont pris de l'ampleur en avril, avec des rapports selon lesquels l'entreprise développait une puce conçue pour les smartphones.

Cette puce est le premier produit de ce qu'OpenAI décrit comme une plateforme de calcul multigénérationnelle, dont le déploiement dans les centres de données devrait commencer plus tard cette année, avec des générations futures prenant en charge une infrastructure d'IA à l'échelle du gigawatt avec Microsoft et d'autres partenaires.

« Notre collaboration avec OpenAI représente un engagement fondamental à développer l'infrastructure physique nécessaire pour la prochaine décennie de l'IA », a déclaré Hock Tan, président et PDG de Broadcom, dans un communiqué. « En co-développant notre silicium leader de l'industrie directement avec OpenAI, nous permettons le déploiement de centres de données à l'échelle du gigawatt avec Microsoft et d'autres partenaires à partir de 2026. »