Nanoblog
Logiciels

OpenAI dévoile Jalapeño, sa nouvelle puce d'inférence pour l'IA

OpenAI a présenté Jalapeño, sa première puce d'inférence, lors de la conférence Hot Chips 2026. Conçue avec Broadcom, elle promet des performances supérieures aux GPU de Nvidia tout en réduisant la consommation électrique.

Publié le 2 min de lecture
OpenAI dévoile Jalapeño, sa nouvelle puce d'inférence pour l'IA — photo Growtika

Une puce d'inférence innovante

OpenAI a dévoilé sa première puce d'inférence, Jalapeño, conçue en partenariat avec Broadcom, lors de la conférence Hot Chips 2026. Cette innovation vise à soutenir les opérations de ChatGPT et d'autres API en offrant une architecture optimisée pour l'inférence des modèles d'intelligence artificielle.

Performance et efficacité énergétique

Les premiers tests de Jalapeño révèlent des gains d'efficacité, atteignant entre 1,5 et 1,9 fois le travail d'IA par watt comparé aux systèmes Nvidia, ainsi qu'une latence réduite de 1,7 à 3,6 fois par rapport aux modèles Nvidia GB200 et GB300. Avec une consommation électrique de 700 W et 216 Go de mémoire HBM4, Jalapeño annonce des performances de 3,4 pétaflops en précision 8 bits et 13,4 pétaflops en précision 4 bits.

Comparaison avec les systèmes Nvidia

Jalapeño a été testée sur trois modèles ouverts, dont GPT-OSS 120B et DeepSeek R1 670B. Sur le modèle GPT-OSS 120B, Jalapeño atteint un débit de 85 448 tokens par seconde, avec une latence de 1,03 seconde, en contraste avec 1,80 seconde pour le système basé sur un GPU Nvidia GB200. Les GPU Nvidia, quant à eux, atteignent 5 pétaflops en 8 bits avec le modèle GB200 et 10 pétaflops en 4 bits avec le modèle GB300, mais consomment plus d'énergie.

Défis et perspectives

Toutefois, ces résultats ont été obtenus dans un cadre contrôlé par OpenAI, soulevant des questions sur leur portée réelle. OpenAI a conçu Jalapeño pour alimenter ChatGPT et d'autres API, mais continuera de s'appuyer sur des GPU Nvidia pour l'entraînement de modèles. L'objectif de Jalapeño sera également de réduire les coûts d'exploitation des data centers, tout en améliorant la latence pour les utilisateurs.

L'avenir de Jalapeño

OpenAI prévoit un déploiement progressif de Jalapeño, avec une montée en puissance prévue à partir de 2027. La société entend poursuivre le développement de nouvelles versions de sa puce. Les résultats initiaux montrent un potentiel qui pourrait transformer le paysage de l'IA, mais il reste à voir comment ces avancées impacteront les utilisateurs et les entreprises.