OpenAI afirma que o Jalapeño superou o Nvidia GB300 em dois benchmarks de inferência a 700 watts, com implantação prevista para o fim de 2026, visando reduzir custos e acelerar respostas.
Pontos principais:
- Segundo a OpenAI, o Jalapeño superou o GB300 da Nvidia em throughput por unidade de energia e em velocidade de resposta nos testes.
- O chip de 700 watts para inferência foi projetado para cortar custos de data centers enquanto entrega respostas de IA mais rápidas.
- O Jalapeño não foi desenvolvido para treinamento de modelos e não foi comparado com a geração mais recente da Nvidia, Vera Rubin.
Benchmarks da OpenAI
A OpenAI afirmou que seu processador proprietário Jalapeño superou o GB300 da Nvidia em testes que medem trabalho de IA por unidade de energia e a velocidade de retorno das respostas.
Richard Ho, chefe de chips da OpenAI, disse que o Jalapeño combina alto throughput com baixa latência, o que pode permitir que clientes escolham modelos priorizando custos menores ou respostas mais rápidas.
Desenvolvido em parceria com a Broadcom, o Jalapeño alcançou esses resultados de teste operando a 700 watts, segundo Ho. Consumo de energia é um dos principais componentes do custo em data centers.
Veja também: Mercado de RWAs salta 48,7%, mas um token explica quase tudo
Contexto da Nvidia
A comparação tem limites claros.
O Jalapeño não foi testado contra a nova geração Vera Rubin da Nvidia, que já começou a ser enviada ao mercado, e o chip da OpenAI é focado em inferência, não em treinamento de modelos. A Nvidia segue como uma fornecedora crucial.
A OpenAI também utiliza tecnologia da Cerebras Systems para parte das cargas de inferência, especialmente com modelos menores, enquanto Ho afirma que o Jalapeño é capaz de lidar com modelos maiores. “Temos uma demanda gigantesca por computação”, disse ele.
Os testes públicos usaram um modelo menor de código aberto da própria OpenAI, ao lado de modelos da DeepSeek e da Moonshot AI, com vantagens mais amplas aparecendo no Kimi, modelo maior da Moonshot. Uma segunda versão do chip já está em estágio avançado, com tape-out esperado nos próximos meses, enquanto a OpenAI iniciou o trabalho conceitual em uma terceira geração.
O chip sucede o anúncio de 24 de junho da OpenAI com a Broadcom, quando as empresas informaram que o Jalapeño passou da fase de design ao tape-out de fabricação em nove meses, com apoio de modelos da própria OpenAI. Essa foi a primeira geração.
Leia a seguir: Nvidia impulsiona plano de IA orbital da SpaceX para 2027, enquanto ambas as ações caem

