OpenAI повідомила, що чип Jalapeño перевершив Nvidia GB300 у двох інференс-бенчмарках при енергоспоживанні 700 Вт. Масштабне розгортання заплановане на другу половину 2026 року й має зменшити витрати та пришвидшити відповіді моделей.
Головне
- За даними OpenAI, Jalapeño обійшов Nvidia GB300 за пропускною здатністю на одиницю спожитої енергії та за швидкістю відповіді.
- Чип для інференсу потужністю 700 Вт розроблено для здешевлення дата-центрів і швидшого обслуговування ШІ‑моделей.
- Jalapeño не призначений для навчання моделей і не порівнювався з новішим поколінням Nvidia Vera Rubin.
Бенчмарки OpenAI
OpenAI повідомила, що її спеціалізований процесор Jalapeño показав кращі результати за Nvidia GB300 у тестах, які вимірювали обсяг ШІ-обчислень на одиницю потужності та швидкість повернення відповіді.
На думку директора напряму чипів OpenAI Річарда Хо, Jalapeño поєднує високу пропускну здатність із низькою затримкою. Це потенційно дає клієнтам змогу обирати конфігурації моделей, які роблять акцент або на мінімізації витрат, або на максимальній швидкості відповіді.
Розроблений спільно з Broadcom, Jalapeño досяг заявлених результатів, працюючи при потужності 700 Вт, уточнив Хо. Споживання електроенергії є одним із ключових драйверів витрат у сучасних дата-центрах.
Також читайте: Ринок RWA зріс на 48,7%, але майже все пояснює один токен
Контекст Nvidia
Порівняння має суттєві обмеження.
Jalapeño не тестувався проти нового покоління Nvidia Vera Rubin, поставки якого вже стартували. Крім того, чип OpenAI створено виключно для інференсу, а не для навчання моделей. Nvidia при цьому залишається для компанії стратегічним постачальником.
OpenAI також використовує технології Cerebras Systems для частини інференс-навантажень, насамперед на менших моделях. Водночас, за словами Хо, Jalapeño здатен ефективно працювати з більшими моделями. «Наш попит на обчислення настільки великий, що нам потрібні всі ці рішення», — пояснив він.
Публічні тести включали одну меншу відкриту модель OpenAI разом із моделями від DeepSeek та Moonshot AI. Найбільш виразна перевага Jalapeño проявилася на більшій моделі Kimi від Moonshot. За словами компанії, друга версія чипа вже на просунутій стадії розробки, і tape-out очікується найближчими місяцями, тоді як OpenAI вже розпочала концептуальні роботи над третім поколінням.
Процесор Jalapeño став продовженням спільної заяви OpenAI та Broadcom від 24 червня, коли компанії оголосили, що змогли пройти шлях від проєктування до tape-out за дев’ять місяців, використовуючи власні моделі OpenAI. Це було перше покоління платформи.
Читайте далі: Nvidia живить орбітальний ШІ-план SpaceX на 2027 рік, попри падіння обох акцій

