OpenAI afirma que o Jalapeño superou o Nvidia GB300 em dois benchmarks de inferência a 700 watts, com início de implantação previsto para o final de 2026, visando reduzir custos e acelerar respostas.
Principais pontos:
- A OpenAI diz que o Jalapeño superou o GB300 da Nvidia em throughput por unidade de energia e em velocidade de resposta nos testes.
- O chip de inferência de 700 watts foi projetado para reduzir o custo de operação de data centers e, ao mesmo tempo, responder mais rapidamente a modelos de IA.
- O Jalapeño não é voltado para treino de modelos e não foi comparado à geração mais recente da Nvidia, Vera Rubin.
Benchmarks da OpenAI
A OpenAI afirmou que o seu processador proprietário Jalapeño superou o GB300 da Nvidia em testes que medem o volume de trabalho de IA por unidade de energia consumida e a velocidade de entrega das respostas.
Richard Ho, responsável pela área de chips da OpenAI, afirmou que o Jalapeño combina alto throughput com baixa latência, permitindo potencialmente que clientes escolham modelos que priorizem menor custo ou respostas mais rápidas.
Desenvolvido em parceria com a Broadcom, o Jalapeño atingiu esses resultados operando a 700 watts, segundo Ho. Consumo de energia é um dos principais componentes de custo de um data center.
Leia também: Mercado de RWAs salta 48,7%, mas um único token explica quase tudo
Contexto Nvidia
A comparação tem limites claros.
O Jalapeño não foi testado frente à linha mais recente da Nvidia, Vera Rubin, que já começou a ser enviada aos clientes, e o chip da OpenAI é desenhado para inferência, não para o treino de modelos. A Nvidia continua a ser um fornecedor estratégico.
A OpenAI também recorre à tecnologia da Cerebras Systems para parte das cargas de inferência, sobretudo com modelos menores, enquanto Ho destaca que o Jalapeño é capaz de tratar modelos maiores. “A nossa necessidade de capacidade computacional é enorme”, afirmou.
Os testes públicos incluíram um modelo open source menor da própria OpenAI, além de modelos da DeepSeek e da Moonshot AI, com vantagens mais claras no Kimi, modelo de maior porte da Moonshot. Uma segunda versão do chip já está em fase avançada, com tape-out previsto para os próximos meses, enquanto a OpenAI iniciou o trabalho conceitual de uma terceira geração.
O chip sucede ao anúncio de 24 de junho feito pela OpenAI e pela Broadcom, quando as empresas informaram que o Jalapeño passou da fase de design para tape-out de fabricação em apenas nove meses, com apoio de modelos da própria OpenAI. Essa foi a primeira geração.
Próximo: Nvidia impulsiona plano de IA orbital da SpaceX para 2027, enquanto ambas as ações recuam

