OpenAI lance la puce Jalapeño pour accélérer l'intelligence artificielle.
Le développement de son propre matériel marque une nouvelle ère pour OpenAI, qui souhaite désormais maîtriser non seulement les modèles et les logiciels, mais aussi les cœurs de processeur, la mémoire et l'infrastructure réseau. La puce, baptisée OpenAI Jalapeño, est conçue pour résoudre le dilemme classique de l'exécution des modèles d'IA : choisir entre débit élevé et faible latence.
Lors de mesures effectuées avec le logiciel libre InferenceX, les performances de la puce OpenAI Jalapeño ont été comparées à celles de solutions commerciales existantes de Nvidia, notamment la plateforme Nvidia Blackwell. Les tests réalisés sur des modèles disponibles publiquement tels que OpenAI GPT-OSS 120B, DeepSeek R1 et Moonshot AI Kimi K2.5 ont démontré que la nouvelle puce affiche une efficacité énergétique par watt consommé 1,5 à 1,9 fois supérieure à débit maximal. Parallèlement, la latence globale a été réduite de 1,7 à 3,6 fois. Ces avantages sont encore plus marqués pour les tâches hautement interactives.
Bien que l'OpenAI Jalapeño soit officiellement donné pour une puissance de 700 W, les mesures ont montré que sa consommation réelle en charge restait inférieure ou égale à 550 W. Pour les développeurs, l'indicateur clé est avant tout la quantité de travail effectuée par unité d'énergie, et non la puissance brute. Lors du traitement de données, ce nouvel accélérateur a démontré un nombre élevé de jetons traités par kilowatt d'énergie, surpassant ainsi les systèmes leaders actuels du marché.
L'architecture de la puce est adaptée aux différentes étapes du traitement des modèles de langage, où les besoins en puissance de calcul et en bande passante mémoire évoluent rapidement. Le nouveau système a été conçu comme un tout, intégrant processeur, mémoire et réseau au niveau des baies de serveurs complètes. Autre fait intéressant : OpenAI a utilisé ses propres outils d'intelligence artificielle pour concevoir la puce, ce qui a permis de réduire le cycle de développement à seulement neuf mois. L'intelligence artificielle a contribué à optimiser les circuits mathématiques individuels et à accélérer l'adaptation du code aux nouveaux modèles.
Bien entendu, les données actuelles proviennent principalement de tests contrôlés, et la stabilité et la rentabilité réelles du système ne seront démontrées que lors de son utilisation en production de masse. OpenAI n'envisage pas non plus d'abandonner complètement ses partenaires actuels. L'entreprise continuera d'utiliser des équipements de Nvidia, AMD, Microsoft, Amazon AWS et d'autres fournisseurs, afin de maintenir une diversité de sources.
L'intégration de la puce OpenAI Jalapeño dans ses propres centres de données devrait débuter d'ici fin 2026. Parallèlement, OpenAI travaille déjà activement à la deuxième et à la troisième génération de ce matériel, dans le but d'assurer à long terme une vitesse encore plus élevée et des coûts de mise en œuvre de ses services plus faibles.
















