OpenAI dévoile son ASIC Jalapeño pour des inférences IA plus rapides
- 01OpenAI présente Jalapeño, un ASIC conçu pour l'inférence IA, développé avec Broadcom.
- 02Jalapeño combine latence réduite et débit accru, évitant un compromis classique en IA.
- 03Les benchmarks montrent une amélioration du nombre de tokens par utilisateur et du débit par kilowatt par rapport aux solutions existantes.

OpenAI annonce un ASIC dédié à l'inférence IA, le Jalapeño, conçu pour réduire la latence et augmenter le débit par rapport aux solutions existantes.
L’ASIC Jalapeño, développé en collaboration avec Broadcom et présenté pour la première fois en juin 2026, est optimisé pour les tâches d’inférence des modèles d’IA. Selon OpenAI, il combine latence réduite et débit accru, deux métriques généralement antagonistes dans les systèmes d’IA. Lors d’un briefing avec des journalistes, Richard Ho, vice-président matériel d’OpenAI, a souligné que cette puce permet d’éviter le compromis traditionnel entre rapidité de réponse et capacité à traiter un grand nombre de requêtes simultanées.
Les benchmarks réalisés par OpenAI et rapportés par The Verge indiquent que le Jalapeño surpasse les puces Nvidia sur des tests d’inférence, notamment en termes de nombre de tokens générés par utilisateur et de débit par kilowatt. Les résultats, obtenus via le benchmark InferenceX de SemiAnalysis, confirment une amélioration des performances énergétiques et une meilleure efficacité pour les charges de travail à grande échelle. Ces tests suggèrent que le Jalapeño pourrait offrir un avantage opérationnel pour les déploiements d’IA en production, où la vitesse et l’évolutivité sont critiques.
Articles liés

OpenAI lance Jalapeño, son chip d'inférence maison, et déploie GPT-5.6 sous pression réglementaire américaine
Analyse des stratégies d'OpenAI pour réduire sa dépendance à Nvidia et s'adapter aux contraintes réglementaires américaines.

OpenAI dévoile Jalapeño, son premier processeur dédié à l'inférence IA
Découverte du premier processeur sur mesure d'OpenAI, conçu pour optimiser les coûts et performances de l'inférence des grands modèles de langage.

Une vice-présidente de Meta quitte l'entreprise pour rejoindre OpenAI en Asie-Pacifique
Stratégie de recrutement d'OpenAI et tensions réglementaires de Meta en Inde.