OpenAI lançou o Ultrafast, uma nova camada de serviço em prévia que roda o GPT-5.6 Sol até 14 vezes mais rápido que o processamento padrão e entrega até 750 tokens de saída por segundo.
Principais pontos:
- Ultrafast roda o GPT-5.6 Sol até 14 vezes mais rápido que o modo padrão.
- O modo é viabilizado pela Cerebras e pode entregar até 750 tokens de saída por segundo.
- O serviço está em prévia limitada, com acesso mais amplo previsto à medida que a capacidade aumenta.
Prévia do OpenAI Ultrafast
A OpenAI anunciou o Ultrafast em 13 de agosto, estreando a camada focada em velocidade primeiro via API para um grupo restrito de clientes. A empresa afirmou que o acesso será ampliado conforme a infraestrutura evoluir.
O serviço é alimentado pela Cerebras e foi projetado para manter as capacidades do GPT-5.6 Sol, reduzindo ao mesmo tempo o tempo necessário para gerar respostas. Tokens de saída são os fragmentos de texto produzidos pelo modelo. Segundo a OpenAI, para obter desempenho em tempo quase real os usuários normalmente precisavam recorrer a modelos menores ou mais especializados; o Ultrafast mira “mais trabalho útil por segundo”.
A OpenAI citou resposta a incidentes, pesquisa financeira, atendimento ao cliente, comércio eletrônico e pesquisa ao vivo entre os fluxos de trabalho que devem se beneficiar mais. Engenheiros podem usar o modo para revisar logs, traces e mudanças recentes de código durante uma interrupção em andamento, enquanto sistemas de suporte conseguem lidar com pedidos de múltiplas etapas em conversas ao vivo.
Veja também: Anthropic busca acordo de US$ 6 bi com a Decart enquanto se prepara para IPO
Impacto do GPT-5.6 Sol
Clientes iniciais afirmam que a nova velocidade muda a forma como o modelo se encaixa em trabalhos interativos. John Crepezzi, da Jane Street, classificou o ganho como “impressionante” e disse que isso torna mais viável realizar trabalho focado lado a lado com modelos.
Courtland Lykins, líder de produto de voz em IA na Podium, afirmou que o Ultrafast tem sido crucial para a pilha de voz da empresa porque “a velocidade muda completamente a experiência da chamada” em tarefas complexas. A OpenAI destacou ainda que pesquisadores financeiros podem analisar sinais de mercado e transações em constante mudança sem depender de processamentos em lote mais lentos — um caso de uso que exige insumos que mudam rapidamente.
A prévia segue limitada mais pela infraestrutura do que por uma estratégia de lançamento amplo ao público. A OpenAI diz que está usando o feedback das empresas iniciais para identificar onde o ganho de velocidade gera mais valor antes de expandir a disponibilidade.
A conexão com a Cerebras antecede o Ultrafast. A OpenAI anunciou em janeiro uma parceria com a fabricante de chips para adicionar 750 megawatts de computação de IA de baixa latência à sua plataforma. Em fevereiro, o GPT-5.3-Codex-Spark se tornou o primeiro modelo ligado a essa parceria, usando hardware da Cerebras para superar a marca de 1.000 tokens por segundo em codificação em tempo real.
Próximo: Volume negociado de Virtuals Protocol salta 180%, touros miram US$ 0,68





