OpenAI apresentou o Ultrafast, um novo escalão de serviço em pré-visualização que executa o GPT-5.6 Sol até 14 vezes mais rápido do que o processamento padrão e é capaz de gerar até 750 tokens de saída por segundo.
Principais destaques:
- Ultrafast executa o GPT-5.6 Sol até 14 vezes mais rápido do que o modo padrão.
- O modo é impulsionado pela Cerebras, entregando até 750 tokens de saída por segundo.
- O serviço está em pré-visualização limitada, com expansão prevista à medida que a capacidade aumenta.
Pré-visualização do OpenAI Ultrafast
A OpenAI anunciou o Ultrafast em 13 de agosto, lançando primeiro este escalão focado em velocidade através da sua API para um grupo restrito de clientes. A empresa afirma que o acesso será ampliado à medida que a infraestrutura escalar.
O serviço é alimentado pela Cerebras e foi concebido para manter as capacidades do GPT-5.6 Sol, reduzindo drasticamente o tempo necessário para gerar respostas. Tokens de saída são fragmentos de texto gerado. Segundo a OpenAI, até agora o desempenho em tempo quase real costumava exigir a escolha de um modelo menor ou mais especializado; o Ultrafast mira “mais trabalho útil por segundo”.
A empresa aponta incident response, pesquisa financeira, atendimento ao cliente, comércio eletrónico e pesquisa em direto entre os fluxos de trabalho que deverão tirar maior partido do novo modo. Engenheiros podem usar o Ultrafast para analisar logs, traces e alterações recentes de código enquanto uma falha ainda decorre, enquanto sistemas de suporte conseguem tratar pedidos complexos, em vários passos, durante conversas em direto.
Veja também: Anthropic busca acordo Decart de US$ 6 bi enquanto se prepara para IPO
Impacto do GPT-5.6 Sol
Clientes iniciais afirmam que o ganho de velocidade muda a forma como o modelo se integra em fluxos de trabalho interativos. John Crepezzi, da Jane Street, classificou o aumento como “impressionante” e disse que ele torna mais viável trabalhar lado a lado com os modelos em tarefas focadas.
Courtland Lykins, responsável de produto para voz em IA na Podium, afirmou que o Ultrafast tem sido decisivo para a stack de voz da empresa, porque “a velocidade muda completamente a experiência da chamada” em tarefas complexas. A OpenAI acrescenta que analistas financeiros podem examinar sinais de mercado e transações em tempo quase real, sem depender de processamento em lotes mais lento — um caso de uso que exige inputs em rápida mutação.
A pré-visualização continua limitada pela infraestrutura disponível, e não por uma estratégia de lançamento massivo. A OpenAI afirma que está a usar o feedback das primeiras empresas para identificar onde o ganho de velocidade gera mais valor antes de abrir o acesso a um público mais amplo.
A ligação com a Cerebras antecede o Ultrafast. Em janeiro, a OpenAI anunciou uma parceria com a fabricante de chips para adicionar 750 megawatts de capacidade de computação de IA de baixa latência à sua plataforma. Em fevereiro, o GPT-5.3-Codex-Spark tornou-se o primeiro modelo associado a essa colaboração, recorrendo ao hardware da Cerebras para ultrapassar os 1.000 tokens por segundo em tarefas de programação em tempo real.
Leia a seguir: Volume de negociação da Virtuals Protocol dispara 180%, touros miram US$ 0,68





