OpenAI poinformowało, że Jalapeño pokonał układ Nvidia GB300 w dwóch testach inferencji przy zasilaniu 700 watów. Produkcyjne wdrożenie akceleratora zaplanowano na drugą połowę 2026 r., aby obniżyć koszty i przyspieszyć działanie usług AI.
Najważniejsze informacje
- Według OpenAI Jalapeño wyprzedził GB300 Nvidii pod względem przepustowości na jednostkę mocy oraz szybkości odpowiedzi.
- Układ do inferencji o poborze 700 W ma ograniczać koszty centrów danych, jednocześnie szybciej obsługując modele AI.
- Jalapeño nie jest przeznaczony do trenowania modeli i nie był porównywany z nowszą generacją Vera Rubin Nvidii.
Testy OpenAI
OpenAI podało, że autorski procesor Jalapeño osiągnął lepsze wyniki niż Nvidia GB300 w pomiarach ilości pracy AI przypadającej na jednostkę zużytej energii oraz szybkości generowania odpowiedzi.
Richard Ho, szef działu układów scalonych w OpenAI, powiedział, że Jalapeño łączy wysoką przepustowość z niskimi opóźnieniami, co może pozwolić klientom dobierać modele pod kątem niższych kosztów lub maksymalnej szybkości odpowiedzi.
Opracowany we współpracy z Broadcomem Jalapeño osiągał wyniki testowe przy mocy 700 W, zaznaczył Ho. Zużycie energii to jeden z głównych składników kosztów w centrach danych.
Zobacz także: Rynek RWA rośnie o 48,7%, ale niemal cały ruch tłumaczy jeden token
Kontekst: pozycja Nvidii
Porównanie ma jednak wyraźne ograniczenia.
Jalapeño nie był zestawiany z nowszą generacją Vera Rubin od Nvidii, która zaczęła już trafiać do klientów. Układ OpenAI zaprojektowano stricte do inferencji, a nie do trenowania modeli. Nvidia pozostaje kluczowym dostawcą sprzętu dla firmy.
OpenAI korzysta również z technologii Cerebras Systems dla części zadań inferencyjnych, zwłaszcza przy mniejszych modelach. Ho podkreślił jednak, że Jalapeño jest w stanie obsługiwać większe sieci. „Nasze zapotrzebowanie na moc obliczeniową jest ogromne” – stwierdził.
W publicznych testach użyto jednego z mniejszych open-source’owych modeli OpenAI oraz modeli DeepSeek i Moonshot AI. Największą przewagę Jalapeño pokazywał przy większym modelu Kimi od Moonshot. Druga generacja układu jest już mocno zaawansowana; tzw. tape-out planowany jest na najbliższe miesiące, a OpenAI rozpoczęło prace koncepcyjne nad trzecią generacją.
Jalapeño to kontynuacja ogłoszonego 24 czerwca wspólnego projektu z Broadcomem, gdy firmy informowały, że pierwsza generacja układu przeszła od etapu projektu do tape-outu produkcyjnego w zaledwie dziewięć miesięcy, przy wsparciu modeli OpenAI.
Czytaj dalej: Nvidia napędza orbitalny plan AI SpaceX na 2027 r., mimo spadków obu akcji

