OpenAI lance Jalapeño, un nouvel accélérateur d’inférence pour défier Nvidia
OpenAI a récemment dévoilé Jalapeño, sa première puce dédiée à l’inférence, développée en collaboration avec Broadcom. Ce nouvel ASIC, conçu spécifiquement pour l’inférence des grands modèles de langage, vise à améliorer l’efficacité énergétique et à réduire la latence par rapport aux GPU Blackwell de Nvidia. OpenAI espère ainsi transformer un marché où chaque mégawatt d’énergie est devenu aussi crucial que chaque pétaflop de performance.
La présentation de Jalapeño a eu lieu lors de l’événement Hot Chips 2026. Contrairement aux GPU polyvalents de Nvidia ou AMD, Jalapeño est optimisé pour des applications particulières, notamment pour alimenter des services tels que ChatGPT et Codex, qui génèrent un volume croissant de tokens.
Conception Technique et Performance
La puce Jalapeño utilise une architecture avancée, intégrant un die de calcul gravé en TSMC N3P et un chiplet d’entrées/sorties N3E. Elle affiche une performance de 13,4 PFLOPS en MXFP4 et est équipée de 216 Gio de HBM4, offrant une bande passante mémoire de 15,4 To/s. Le TDP est fixé à 700 W, mais OpenAI a mesuré une consommation réelle de moins de 550 W lors des tests.
Un rack de Jalapeño peut contenir 128 accélérateurs, ce qui représente environ 1,7 exaflops de calcul en 4 bits et 27,5 To de HBM4. De plus, jusqu’à seize racks peuvent être interconnectés, permettant de créer un domaine de 2 048 puces.
Avantages Concurrentiels
OpenAI affirme que Jalapeño permet d’atteindre entre 1,5 et 1,9 fois plus de travail par watt par rapport aux systèmes Nvidia, avec une latence de bout en bout réduite de 1,7 à 3,6 fois. Toutefois, ces résultats, bien que prometteurs, doivent être interprétés avec précaution, car ils proviennent des laboratoires d’OpenAI et concernent des scénarios optimisés.
OpenAI ne prévoit pas de se passer complètement des GPU Nvidia, car Jalapeño ne couvre pas les besoins d’entraînement des modèles. Les premiers exemplaires de Jalapeño devraient être disponibles en faible volume d’ici fin 2026, avec une montée en puissance prévue pour 2027.
Contexte Énergétique et Stratégique
Dans un contexte où les datacenters sont de plus en plus contraints par des limites d’alimentation et de refroidissement, la capacité à produire davantage de tokens par mégawatt représente un enjeu économique crucial pour les entreprises d’IA. Jalapeño permet à OpenAI de diminuer sa dépendance envers Nvidia, tout en continuant à utiliser ses produits dans certaines applications.
La concurrence est également accrue, avec des entreprises comme Google, AWS, Microsoft et AMD qui développent leurs propres solutions pour répondre à des besoins similaires. Jalapeño ne remplace pas encore Nvidia, mais marque une évolution significative vers une plus grande autonomie des acteurs de l’IA dans la conception de leurs propres solutions matérielles.
Source : Informatiquenews.fr

