OpenAI meldt dat Jalapeño de Nvidia GB300 heeft geklopt in twee inference-benchmarks bij 700 watt. De chip moet in de loop van 2026 op grotere schaal worden ingezet om kosten te drukken en antwoorden te versnellen.
Belangrijkste punten:
- Volgens OpenAI presteerde Jalapeño beter dan Nvidia’s GB300 in throughput per verbruikte watt en in reactiesnelheid tijdens tests.
- De 700 watt‑inferencechip is ontworpen om datacenterkosten te verlagen en AI‑modellen sneller te bedienen.
- Jalapeño is niet bedoeld voor modeltraining en is niet vergeleken met Nvidia’s nieuwste Vera Rubin‑generatie.
OpenAI-benchmarks
OpenAI verklaarde dat de eigen Jalapeño‑processor beter presteerde dan Nvidia’s GB300 in tests die zowel AI‑werk per verbruikte hoeveelheid stroom als de snelheid van antwoordteruggave maten.
Richard Ho, chipbaas bij OpenAI, zegt dat Jalapeño hoge throughput combineert met lage latency, waardoor klanten makkelijker kunnen kiezen tussen modellen die óf op lagere kosten óf op snellere antwoorden zijn geoptimaliseerd.
Jalapeño is ontwikkeld met Broadcom en behaalde de testresultaten bij een verbruik van 700 watt, aldus Ho. Stroom is een van de grootste kostenposten in datacenters.
Ook interessant: RWA-markt stijgt 48,7%, maar één token verklaart bijna alles
Nvidia in perspectief
De vergelijking kent duidelijke beperkingen.
Jalapeño is niet getest tegen Nvidia’s nieuwere Vera Rubin‑generatie, die al wordt uitgeleverd, en de OpenAI‑chip is specifiek ontworpen voor inference, niet voor het trainen van modellen. Nvidia blijft bovendien een cruciale leverancier.
OpenAI maakt daarnaast gebruik van technologie van Cerebras Systems voor bepaalde inference‑workloads, vooral bij kleinere modellen. Ho stelt dat Jalapeño juist grotere modellen aankan. “We hebben zóveel rekenkracht nodig,” aldus Ho.
Voor de openbare tests werd één kleiner open‑sourcemodel van OpenAI gebruikt, naast modellen van DeepSeek en Moonshot AI. De grootste voordelen kwamen naar voren bij Kimi, het grotere model van Moonshot. Een tweede Jalapeño‑versie is volgens OpenAI al vergevorderd, met tape‑out in de komende maanden, terwijl er conceptueel al wordt gewerkt aan een derde generatie.
De chip volgt op de aankondiging van 24 juni door OpenAI en Broadcom, waarin de bedrijven meldden dat Jalapeño in negen maanden tijd van ontwerp naar manufacturing tape‑out is gegaan met hulp van OpenAI‑modellen. Dat betrof de eerste generatie.
Lees verder: Nvidia ondersteunt SpaceX’ AI‑plannen in de ruimte voor 2027 terwijl beide aandelen dalen

