OpenAI affirme que sa puce Jalapeño a dépassé le Nvidia GB300 dans deux benchmarks d’inférence à 700 watts, avec un déploiement prévu plus tard en 2026 pour réduire les coûts et accélérer les temps de réponse.
Points clés :
- OpenAI indique que Jalapeño devance le GB300 de Nvidia en débit par unité de puissance et en vitesse de réponse lors des tests.
- Cette puce d’inférence de 700 watts vise à abaisser les coûts des data centers tout en servant les modèles d’IA plus rapidement.
- Jalapeño n’est pas conçue pour l’entraînement de modèles et n’a pas été comparée à la nouvelle génération Vera Rubin de Nvidia.
Les benchmarks d’OpenAI
OpenAI a déclaré que son processeur maison Jalapeño a surperformé le GB300 de Nvidia dans des tests mesurant la quantité de travail d’IA réalisée par unité de puissance ainsi que la rapidité de génération des réponses.
Richard Ho, responsable des puces chez OpenAI, explique que Jalapeño combine un haut débit et une faible latence, offrant potentiellement aux clients le choix entre des modèles optimisés pour la baisse des coûts ou pour la vitesse de réponse.
Développée avec Broadcom, Jalapeño a obtenu ces résultats de test en fonctionnant à 700 watts, selon Ho. La consommation électrique est l’un des principaux postes de coût des centres de données.
À lire aussi : Le marché des RWA bondit de 48,7 %, mais un seul token explique presque tout
Le contexte côté Nvidia
La comparaison comporte des limites évidentes.
Jalapeño n’a pas été testée face à la génération plus récente Vera Rubin de Nvidia, déjà en cours de livraison, et la puce d’OpenAI est conçue pour l’inférence, non pour l’entraînement de modèles. Nvidia reste par ailleurs un fournisseur stratégique d’OpenAI.
OpenAI utilise également la technologie de Cerebras Systems pour certaines charges d’inférence, notamment avec des modèles plus petits, tandis que Ho affirme que Jalapeño peut prendre en charge des modèles plus volumineux. « Nos besoins en capacité de calcul sont immenses », souligne-t-il.
Les tests publics ont mobilisé un petit modèle open source d’OpenAI, ainsi que des modèles de DeepSeek et de Moonshot AI. Les gains les plus marqués sont apparus sur le grand modèle Kimi de Moonshot. Une deuxième version de la puce est déjà bien avancée, avec un tape-out attendu dans les prochains mois, et OpenAI a entamé les travaux de conception d’une troisième génération.
Cette puce s’inscrit dans la continuité de l’annonce du 24 juin d’OpenAI et Broadcom, lorsque les deux groupes avaient indiqué que Jalapeño était passée de la phase de conception au tape-out industriel en neuf mois, avec l’appui des modèles d’OpenAI. Il s’agissait de la première génération.
À suivre : Nvidia alimente le projet d’IA orbitale 2027 de SpaceX tandis que les deux actions reculent

