OpenAI ha presentado Ultrafast, un nuevo nivel de servicio en vista previa que ejecuta GPT-5.6 Sol hasta 14 veces más rápido que el procesamiento estándar y alcanza hasta 750 tokens de salida por segundo.
Claves:
- Ultrafast ejecuta GPT-5.6 Sol hasta 14 veces más rápido que el modo estándar.
- Cerebras potencia este modo, capaz de ofrecer hasta 750 tokens de salida por segundo.
- El servicio está en vista previa limitada, con una apertura gradual a medida que aumente la capacidad.
Vista previa de OpenAI Ultrafast
OpenAI anunció Ultrafast el 13 de agosto, lanzando primero este nivel centrado en la velocidad a través de su API para un grupo reducido de clientes. La compañía adelantó que el acceso se ampliará progresivamente a medida que crezca la capacidad.
El servicio está impulsado por Cerebras y está diseñado para mantener las capacidades de GPT-5.6 Sol, reduciendo al mismo tiempo el tiempo necesario para generar respuestas. Los tokens de salida son fragmentos de texto generado. OpenAI señaló que, hasta ahora, el rendimiento casi en tiempo real solía exigir elegir modelos más pequeños o especializados, mientras que Ultrafast apunta a ofrecer “más trabajo útil por segundo”.
OpenAI identificó la respuesta a incidentes, el análisis financiero, la atención al cliente, el comercio electrónico y la investigación en vivo como algunos de los flujos de trabajo que más se beneficiarían. Los ingenieros pueden aprovechar este modo para revisar registros, trazas y cambios recientes de código durante una caída del sistema, mientras que las plataformas de soporte pueden gestionar solicitudes de varios pasos en conversaciones en directo.
También puede interesarte: Anthropic busca un acuerdo Decart de $6B mientras se prepara para salir a bolsa
Impacto de GPT-5.6 Sol
Los primeros clientes afirman que la nueva velocidad redefine cómo encaja el modelo en tareas interactivas. John Crepezzi, de Jane Street, calificó el salto de “impresionante” y aseguró que hace mucho más viable trabajar codo con codo con los modelos en tareas de alta concentración.
Courtland Lykins, responsable de producto de voz con IA en Podium, señaló que Ultrafast ha sido clave para la pila de voz de la compañía, porque “la velocidad cambia por completo la experiencia de la llamada” en trabajos complejos. OpenAI añadió que los analistas financieros pueden estudiar señales de mercado y operaciones en movimiento sin depender de procesados por lotes más lentos, un caso de uso que exige entradas que cambian a gran velocidad.
La vista previa sigue limitada por la infraestructura, no por una apertura general al público. OpenAI explicó que está utilizando el feedback de las primeras empresas para determinar en qué ámbitos la mayor velocidad genera más valor antes de ampliar el acceso.
La relación con Cerebras es anterior a Ultrafast. OpenAI anunció en enero una alianza con el fabricante de chips para incorporar 750 megavatios de computación de IA de baja latencia a su plataforma. En febrero, GPT-5.3-Codex-Spark se convirtió en el primer modelo ligado a ese acuerdo, utilizando hardware de Cerebras para superar los 1.000 tokens por segundo en programación en tiempo real.
Siguiente lectura: El volumen de negociación de Virtuals Protocol se dispara un 180% y los alcistas apuntan a $0.68





