OpenAI afirma que o chip Jalapeño superou o Nvidia GB300 em dois testes de inferência operando a 700 watts, com implantação prevista para o fim de 2026, visando reduzir custos e acelerar respostas.
Principais pontos:
- Segundo a OpenAI, o Jalapeño superou o GB300 da Nvidia em taxa de processamento por unidade de energia e em velocidade de resposta.
- O chip de inferência de 700 watts foi projetado para reduzir custos de data center enquanto atende modelos de IA com mais rapidez.
- O Jalapeño não foi desenvolvido para treinamento de modelos e não foi comparado com a geração mais recente Vera Rubin da Nvidia.
Benchmarks da OpenAI
A OpenAI informou que seu processador customizado Jalapeño superou o GB300 da Nvidia em testes que medem tanto o volume de trabalho de IA por unidade de energia quanto a velocidade de entrega das respostas.
Richard Ho, chefe de chips da OpenAI, afirmou que o Jalapeño combina alta taxa de processamento com baixa latência, o que pode permitir que clientes escolham modelos que priorizem menor custo ou respostas mais rápidas.
Desenvolvido em parceria com a Broadcom, o Jalapeño alcançou esses resultados de teste operando a 700 watts, segundo Ho. Consumo de energia é um dos principais componentes de custo em data centers.
Leia também: Mercado de RWA salta 48,7%, mas um único token explica quase tudo
Contexto da Nvidia
A comparação tem limites claros.
O Jalapeño não foi testado contra a geração mais recente da Nvidia, Vera Rubin, que já começou a ser entregue, e o chip da OpenAI é voltado a inferência, não a treinamento de modelos. A Nvidia segue como fornecedora estratégica.
A OpenAI também utiliza tecnologia da Cerebras Systems em algumas cargas de inferência, principalmente com modelos menores, enquanto Ho afirma que o Jalapeño consegue lidar com modelos maiores. “Temos uma demanda gigantesca por capacidade computacional”, disse ele.
Nos testes públicos, foi usado um modelo menor de código aberto da própria OpenAI, além de modelos da DeepSeek e da Moonshot AI, com vantagens mais claras surgindo no Kimi, modelo maior da Moonshot. Uma segunda versão do chip já está em estágio avançado, com tape-out previsto para os próximos meses, enquanto a OpenAI já iniciou o trabalho conceitual em uma terceira geração.
O chip é o sucessor do anúncio de 24 de junho da OpenAI com a Broadcom, quando as empresas disseram que o Jalapeño passou da fase de design ao tape-out de fabricação em nove meses, com apoio de modelos da própria OpenAI. Aquela foi a primeira geração.
Próximo tema: Nvidia impulsiona plano de IA orbital da SpaceX para 2027 enquanto as duas ações caem





