OpenAI informuje, że Jalapeño pokonał Nvidię GB300 w dwóch benchmarkach inferencyjnych przy poborze 700 watów. Wdrożenie układu planowane jest na drugą połowę 2026 r., z myślą o obniżeniu kosztów oraz przyspieszeniu odpowiedzi modeli AI.
Najważniejsze informacje:
- Według OpenAI Jalapeño wyprzedził GB300 Nvidii pod względem przepustowości na jednostkę mocy oraz szybkości odpowiedzi.
- Układ inferencyjny o mocy 700 W ma ograniczyć koszty centrów danych, jednocześnie szybciej obsługując zapytania do modeli AI.
- Jalapeño nie jest przeznaczony do trenowania modeli i nie był porównywany z nowszą generacją układów Nvidii Vera Rubin.
Benchmarki OpenAI
OpenAI poinformowało, że jego autorski procesor Jalapeño w testach przewyższył Nvidię GB300 w zakresie ilości pracy AI wykonanej na jednostkę pobieranej mocy oraz w szybkości generowania odpowiedzi.
Richard Ho, szef działu układów scalonych w OpenAI, podkreśla, że Jalapeño łączy wysoką przepustowość z niskimi opóźnieniami, co może pozwolić klientom dobierać modele pod kątem niższego kosztu lub szybszej odpowiedzi – w zależności od priorytetów.
Opracowany we współpracy z Broadcomem Jalapeño osiąga deklarowane wyniki przy pracy z limitem 700 watów, jak zaznacza Ho. Zużycie energii pozostaje jednym z kluczowych składników kosztów operacyjnych centrów danych.
Zobacz też: Rynek RWA rośnie o 48,7%, ale niemal wszystko tłumaczy jeden token
Kontekst: Nvidia
Porównanie ma jednak wyraźne ograniczenia.
Jalapeño nie był zestawiany z nowszą generacją układów Nvidii Vera Rubin, które są już dostarczane klientom. Chip OpenAI został zaprojektowany przede wszystkim do inferencji, a nie do trenowania modeli. Nvidia pozostaje jednocześnie kluczowym dostawcą sprzętu dla OpenAI.
OpenAI korzysta także z technologii Cerebras Systems przy części zadań inferencyjnych, zwłaszcza dla mniejszych modeli. Ho przekonuje jednak, że Jalapeño jest w stanie obsługiwać większe konstrukcje. „Nasze zapotrzebowanie na moc obliczeniową jest ogromne” – stwierdził.
W publicznych testach użyto jednego mniejszego, otwartoźródłowego modelu OpenAI oraz modeli od DeepSeek i Moonshot AI. Najbardziej widoczną przewagę Jalapeño zanotowano przy większym modelu Kimi od Moonshot. Druga generacja układu jest już mocno zaawansowana – tzw. tape-out ma nastąpić w najbliższych miesiącach, a OpenAI rozpoczęło już prace koncepcyjne nad trzecią generacją.
Jalapeño jest kontynuacją ogłoszonego 24 czerwca projektu z Broadcomem. Firmy informowały wówczas, że pierwsza generacja układu przeszła drogę od projektu do tape-outu w zaledwie dziewięć miesięcy, przy wykorzystaniu modeli OpenAI w procesie projektowym.
Czytaj dalej: Nvidia zasila orbitalny plan AI SpaceX na 2027 r., podczas gdy obie spółki tracą na wartości





