OpenAI apresentou o Ultrafast, uma nova camada de serviço em prévia que executa o GPT-5.6 Sol até 14 vezes mais rápido que o processamento padrão e é capaz de gerar até 750 tokens de saída por segundo.
Principais pontos:
- Ultrafast executa o GPT-5.6 Sol até 14 vezes mais rápido que o modo padrão.
- Cerebras fornece a infraestrutura do modo, que atinge até 750 tokens de saída por segundo.
- O serviço está em prévia limitada, com ampliação de acesso prevista conforme a capacidade aumenta.
Prévia do OpenAI Ultrafast
A OpenAI anunciou o Ultrafast em 13 de agosto, lançando primeiro, via API, esse nível focado em velocidade para um grupo restrito de clientes. A empresa afirma que o acesso será ampliado à medida que a capacidade for crescendo.
O serviço é impulsionado pela Cerebras e foi desenhado para preservar as capacidades do GPT-5.6 Sol, ao mesmo tempo em que reduz o tempo necessário para gerar respostas. Tokens de saída são fragmentos de texto gerado. Segundo a OpenAI, desempenho em tempo real normalmente exigia optar por modelos menores ou muito especializados, enquanto o Ultrafast busca entregar “mais trabalho útil por segundo”.
A OpenAI citou resposta a incidentes, pesquisa financeira, atendimento ao cliente, comércio eletrônico e pesquisa em tempo real entre os fluxos de trabalho que devem se beneficiar mais. Engenheiros podem usar o modo para revisar logs, traces e alterações recentes de código enquanto uma indisponibilidade está em andamento, e sistemas de suporte podem lidar com pedidos multi-etapas em conversas ao vivo.
Leia também: Anthropic busca acordo de US$ 6 bi com a Decart enquanto se prepara para abrir capital
Impacto do GPT-5.6 Sol
Clientes iniciais afirmam que o ganho de velocidade muda a forma como o modelo se encaixa em trabalhos interativos. John Crepezzi, da Jane Street, classificou o salto como “impressionante” e disse que ele torna mais viável realizar trabalho focado lado a lado com os modelos.
Courtland Lykins, líder de produto de voz em IA na Podium, afirmou que o Ultrafast tem sido valioso para a pilha de voz da empresa porque “a velocidade muda completamente a experiência da chamada” em tarefas complexas. A OpenAI acrescentou que analistas financeiros podem avaliar sinais de mercado e transações em mudança constante sem depender de processamento em lote mais lento. Esse tipo de uso exige lidar com insumos que se alteram rapidamente.
A prévia continua limitada mais pela infraestrutura do que por uma decisão de abertura ampla ao público. A OpenAI afirma estar usando o feedback das primeiras empresas para identificar em quais casos o aumento de velocidade gera mais valor antes de ampliar a disponibilidade.
A parceria com a Cerebras é anterior ao Ultrafast. A OpenAI anunciou em janeiro um acordo com a fabricante de chips para adicionar 750 megawatts de capacidade de computação de IA de baixa latência à sua plataforma. Em fevereiro, o GPT-5.3-Codex-Spark se tornou o primeiro modelo ligado a esse acordo, usando hardware da Cerebras para superar a marca de 1.000 tokens por segundo em programação em tempo real.
Leia a seguir: Volume de negociação do Virtuals Protocol dispara 180%, com touros mirando US$ 0,68





