OpenAI ha presentado Ultrafast, una modalidad de servicio en fase preliminar que ejecuta GPT-5.6 Sol hasta 14 veces más rápido que el procesamiento estándar y es capaz de generar hasta 750 tokens de salida por segundo.
Claves:
- Ultrafast ejecuta GPT-5.6 Sol hasta 14 veces más rápido que el modo estándar.
- Cerebras proporciona la infraestructura para este modo, que alcanza hasta 750 tokens por segundo.
- El servicio está en vista previa limitada, con un despliegue más amplio previsto a medida que crezca la capacidad.
Vista previa de OpenAI Ultrafast
OpenAI anunció Ultrafast el 13 de agosto, lanzando primero este nivel centrado en la velocidad a través de su API para un grupo reducido de clientes. La compañía indicó que el acceso se ampliará conforme aumente la capacidad.
El servicio se apoya en tecnología de Cerebras y está diseñado para mantener las capacidades de GPT-5.6 Sol reduciendo al mismo tiempo el tiempo necesario para generar respuestas. Los tokens de salida son fragmentos de texto generado. OpenAI señaló que, hasta ahora, el rendimiento en tiempo real solía exigir sacrificar potencia eligiendo modelos más pequeños o muy específicos, mientras que Ultrafast persigue “más trabajo útil por segundo”.
OpenAI citó casos como respuesta a incidentes, análisis financiero, atención al cliente, comercio electrónico e investigación en vivo entre los flujos de trabajo que más se beneficiarán. Los ingenieros pueden utilizar este modo para revisar logs, trazas y cambios recientes de código mientras se desarrolla una caída del sistema, y las plataformas de soporte pueden resolver solicitudes de varios pasos durante conversaciones en directo.
También puede interesarle: Anthropic busca un acuerdo Decart de 6.000 millones de dólares mientras prepara su salida a bolsa
Impacto de GPT-5.6 Sol
Los primeros clientes apuntan a que la nueva velocidad cambia la forma en que el modelo encaja en el trabajo interactivo. John Crepezzi, de Jane Street, calificó el salto de rendimiento como “impresionante” y afirmó que hace más viable trabajar codo con codo con los modelos en tareas de alta concentración.
Courtland Lykins, responsable de producto de voz con IA en Podium, señaló que Ultrafast ha sido clave para la pila de voz de la compañía porque “la velocidad transforma por completo la experiencia de la llamada” en tareas complejas. OpenAI añadió que los analistas financieros pueden examinar señales de mercado y operaciones en tiempo real sin tener que esperar a procesos por lotes más lentos, un caso de uso muy dependiente de entradas que cambian rápidamente.
La vista previa sigue limitada por la infraestructura disponible y no por una decisión de lanzamiento masivo. OpenAI afirma que está utilizando el feedback de las primeras empresas para identificar en qué ámbitos la velocidad genera más valor antes de abrir la herramienta a un público más amplio.
La relación con Cerebras es anterior a Ultrafast. OpenAI anunció en enero una alianza con el fabricante de chips para incorporar 750 megavatios de computación de IA de baja latencia a su plataforma. En febrero, GPT-5.3-Codex-Spark se convirtió en el primer modelo asociado a ese acuerdo, utilizando hardware de Cerebras para superar los 1.000 tokens por segundo en programación en tiempo real.
Lea a continuación: El volumen de negociación de Virtuals Protocol se dispara un 180% y los alcistas fijan la mira en 0,68 dólares





