OpenAI affirme que sa puce Jalapeño a devancé la Nvidia GB300 sur deux benchmarks d’inférence à 700 watts, avec un déploiement prévu pour la fin 2026 afin de réduire les coûts et d’accélérer les temps de réponse.
À retenir
- OpenAI assure que Jalapeño a pris l’avantage sur la GB300 de Nvidia en débit par unité de puissance et en rapidité de réponse durant les tests.
- Cette puce d’inférence de 700 watts vise à abaisser les coûts des centres de données tout en servant les modèles d’IA plus rapidement.
- Jalapeño n’est pas conçue pour l’entraînement de modèles et n’a pas été comparée à la génération plus récente Vera Rubin de Nvidia.
Les benchmarks d’OpenAI
OpenAI a indiqué que son processeur maison Jalapeño a surpassé la Nvidia GB300 dans des tests mesurant la quantité de calcul d’IA par unité de puissance consommée et la vitesse de restitution des réponses.
Richard Ho, responsable des puces chez OpenAI, explique que Jalapeño combine un fort débit avec une faible latence, ce qui pourrait permettre aux clients de choisir des modèles optimisés soit pour des coûts plus bas, soit pour des réponses plus rapides.
Développée avec Broadcom, Jalapeño a atteint ces résultats en fonctionnement à 700 watts, selon Ho. La consommation énergétique est l’un des principaux postes de coût des data centers.
À lire aussi : Le marché des RWA bondit de 48,7 %, mais un seul token explique presque tout
Le contexte côté Nvidia
La comparaison a toutefois ses limites.
Jalapeño n’a pas été testée face à la génération plus récente Vera Rubin de Nvidia, déjà en cours de livraison, et la puce d’OpenAI est spécifiquement conçue pour l’inférence, pas pour l’entraînement de modèles. Nvidia reste par ailleurs un fournisseur clé d’OpenAI.
OpenAI s’appuie aussi sur la technologie de Cerebras Systems pour une partie de ses charges d’inférence, notamment avec des modèles plus petits, tandis que Ho affirme que Jalapeño est capable de prendre en charge des modèles plus volumineux. « Nous avons un besoin colossal en capacité de calcul », souligne-t-il.
Les tests publics ont utilisé un petit modèle open source d’OpenAI, ainsi que des modèles de DeepSeek et Moonshot AI. Les gains les plus nets seraient apparus sur le grand modèle Kimi de Moonshot. Une deuxième version de la puce est déjà très avancée, avec un tape-out attendu dans les prochains mois, tandis qu’OpenAI a commencé les travaux de conception d’une troisième génération.
Jalapeño s’inscrit dans la continuité de l’annonce du 24 juin d’OpenAI avec Broadcom, lorsque les deux groupes avaient indiqué que la puce était passée de la phase de design au tape-out industriel en neuf mois, avec l’appui des modèles d’OpenAI. Il s’agissait de la première génération.
À suivre : Nvidia alimente le projet d’IA orbitale 2027 de SpaceX, malgré le repli des deux actions





