OpenAI заявляє, що процесор Jalapeño обійшов Nvidia GB300 у двох інференс‑тестах при споживанні 700 Вт. Компанія планує розгортання чипа у 2026 році, розраховуючи знизити витрати та прискорити відповіді моделей ШІ.
Ключові тези:
- За словами OpenAI, у випробуваннях Jalapeño випередив Nvidia GB300 за продуктивністю на одиницю спожитої енергії та швидкістю відповіді.
- 700‑ватний чип для інференсу створено, щоб зменшити витрати дата‑центрів і одночасно швидше обслуговувати AI‑запити.
- Jalapeño не призначений для навчання моделей і не порівнювався з новішим поколінням Nvidia Vera Rubin.
Бенчмарки OpenAI
OpenAI повідомила, що її спеціалізований процесор Jalapeño перевищив Nvidia GB300 у тестах, які вимірювали обсяг виконаної AI‑роботи на одиницю потужності та швидкість отримання відповідей.
Керівник напрямку чипів OpenAI Річард Хо зазначив, що Jalapeño поєднує високу пропускну здатність із низькою затримкою. Це потенційно дає клієнтам змогу обирати моделі, які оптимізовані або під нижчу собівартість, або під максимально швидкі відповіді.
Розроблений спільно з Broadcom Jalapeño досяг заявлених результатів, працюючи при споживанні 700 Вт, уточнив Хо. Витрати на електроенергію є одним із ключових драйверів собівартості дата‑центрів.
Також читайте: Ринок RWA зріс на 48,7%, але один токен пояснює майже все
Контекст Nvidia
Порівняння має суттєві обмеження.
Jalapeño не тестували проти новішої лінійки Nvidia Vera Rubin, постачання якої вже стартувало, а сам чип OpenAI заточений під інференс, а не під навчання моделей. Nvidia при цьому залишається для OpenAI ключовим постачальником обчислювального «заліза».
OpenAI також використовує технології Cerebras Systems для частини інференс‑навантажень, особливо зі скромнішими моделями, тоді як, за словами Хо, Jalapeño здатен обробляти значно більші. «Наш попит на обчислення колосальний», — наголосив він.
Публічні тести проводили із використанням однієї з менших відкритих моделей OpenAI, а також моделей від DeepSeek і Moonshot AI. Найпомітніші переваги Jalapeño проявилися на більшій моделі Kimi від Moonshot. Друга версія чипа вже на просунутій стадії: tape‑out очікується в найближчі місяці, тоді як OpenAI вже веде концептуальні роботи над третім поколінням.
Jalapeño став продовженням оголошення OpenAI від 24 червня, зробленого спільно з Broadcom. Тоді компанії заявили, що перевели чип із етапу проєктування до виробничого tape‑out лише за дев’ять місяців, використовуючи власні моделі OpenAI. Це було перше покоління лінійки.
Читайте далі: Nvidia живить орбітальний AI‑план SpaceX на 2027 рік, поки обидві акції падають





