OpenAI afirma que o Jalapeño superou o Nvidia GB300 em dois benchmarks de inferência a 700 watts, com início de implantação previsto para o final de 2026, visando reduzir custos e acelerar respostas.
Principais destaques:
- Segundo a OpenAI, o Jalapeño superou o GB300 da Nvidia em throughput por unidade de energia e velocidade de resposta nos testes.
- O chip de inferência de 700 watts foi projetado para reduzir custos de data center e, ao mesmo tempo, atender modelos de IA mais rapidamente.
- O Jalapeño não foi desenvolvido para treino de modelos e não foi comparado com a geração mais recente da Nvidia, Vera Rubin.
Benchmarks da OpenAI
A OpenAI informou que o seu processador proprietário Jalapeño superou o GB300 da Nvidia em testes que medem a quantidade de trabalho de IA por unidade de energia e a rapidez na entrega de respostas.
Richard Ho, responsável pela área de chips na OpenAI, afirmou que o Jalapeño combina alto throughput com baixa latência, permitindo potencialmente que os clientes escolham modelos que priorizem custos mais baixos ou respostas mais rápidas.
Desenvolvido em parceria com a Broadcom, o Jalapeño atingiu os resultados de teste operando a 700 watts, segundo Ho. Consumo de energia é um dos principais componentes do custo de um data center.
Leia também: Mercado de RWA salta 48,7%, mas um único token explica quase tudo
Contexto da Nvidia
A comparação, porém, tem limites claros.
O Jalapeño não foi testado frente à geração mais recente da Nvidia, Vera Rubin, que já começou a ser entregue ao mercado, e o chip da OpenAI é voltado a inferência, não a treino de modelos. A Nvidia continua a ser um fornecedor estratégico para a empresa.
A OpenAI também recorre à tecnologia da Cerebras Systems para parte das cargas de inferência, sobretudo com modelos menores, enquanto Ho disse que o Jalapeño é capaz de lidar com modelos maiores. “Nossa demanda por capacidade de computação é enorme”, afirmou.
A bateria de testes públicos utilizou um modelo menor de código aberto da própria OpenAI, além de modelos da DeepSeek e da Moonshot AI, com vantagens mais amplas surgindo no Kimi, modelo maior da Moonshot. Uma segunda versão do chip já está bem avançada, com tape-out previsto para os próximos meses, enquanto a OpenAI já iniciou o trabalho conceitual em uma terceira geração.
O Jalapeño sucede o anúncio de 24 de junho feito pela OpenAI em conjunto com a Broadcom, quando as empresas informaram que o chip passou da fase de design para tape-out de fabricação em nove meses, com apoio dos próprios modelos da OpenAI. Esse foi o primeiro ciclo de geração.
Leia a seguir: Nvidia impulsiona plano de IA orbital da SpaceX para 2027 enquanto ambas as ações recuam





