OpenAI identifica tres fallos detrás del brusco frenazo de GPT‑6 Astra

Three faults named by OpenAI's Tibo Sottiaux explain why GPT-6 Astra slipped for a week of testing (Image: Shutterstock)
Three faults named by OpenAI's Tibo Sottiaux explain why GPT-6 Astra slipped for a week of testing (Image: Shutterstock)

OpenAI ha resuelto tres fallos que estuvieron detrás de una semana de quejas de usuarios sobre la supuesta pérdida de nivel de su nuevo modelo GPT-6 Astra tras su lanzamiento, y ha restablecido los límites de uso para los suscriptores de Codex.

Puntos clave:

  • Usuarios de Astra pasaron la semana publicando pruebas comparativas que apuntaban a que el modelo se había debilitado en silencio desde el lanzamiento.
  • El responsable de Codex en OpenAI identificó tres causas, incluido un experimento de gestión de contexto que afectó a entre 4.000 y 5.000 usuarios.
  • El anterior buque insignia de la compañía, GPT-5.6 Sol, recibió la misma acusación en julio.

OpenAI corrige los defectos de calidad en Astra

El responsable de producto de Codex, Tibo Sottiaux, explicó que el equipo trabajó con usuarios para rastrear el origen de los fallos, desplegar correcciones y aplicar un restablecimiento completo de uso antes de la medianoche hora local, según una actualización publicada el sábado. Funciones escritas para modelos anteriores se activaban con demasiada frecuencia, llegando en ocasiones a impedir que Astra comprobara su propio trabajo.

Un experimento opcional de gestión de contexto también podía hacer que el modelo se detuviera antes de tiempo o respondiera a mensajes desfasados. OpenAI lo deshabilitó después de que la prueba afectara aproximadamente a entre 4.000 y 5.000 usuarios. Algunos motores estaban mal configurados y degradaban de forma medible la calidad en el tráfico residual que se les dirigía, por lo que la compañía retiró esos motores e introdujo varias correcciones menores adicionales. Sottiaux escribió que el modelo ahora sigue con más precisión el último mensaje del usuario.

También en cartera: Ethereum se topa con un muro de oferta en 2.800 dólares tras dispararse las entradas en ETF a 216 millones

Usuarios de Astra denuncian retrocesos en programación

Las quejas fueron creciendo durante la semana en X, donde desarrolladores lanzaron los mismos prompts contra la versión de Astra del día de salida y la versión actual, manteniendo intacta la configuración, y luego compararon los resultados. El desarrollador Pranjal Paliwal, que días antes había elogiado el modelo, revisó el código que Astra había generado para él y calificó el resultado como una regresión, no un avance.

Dax Raad, creador de la herramienta de programación Opencode, decidió regresar con su equipo al anterior GPT-5.6 Sol después de que el gasto en Astra prácticamente se duplicara a cambio de unas desventajas que, a su juicio, no compensaban el coste.

Un usuario en los foros describió a Astra como un modelo que ahora rinde al mismo nivel que Sol en tareas idénticas, con el mismo número de reintentos. No todos compartieron ese diagnóstico: un usuario seudónimo bajo el alias Antikythera sostuvo que el modelo siempre había sido “perezoso” y proclive a abusar de las viñetas, y que simplemente había pasado el efecto deslumbrante inicial.

Los límites de cómputo ensombrecen a GPT‑6 Astra

La capacidad de cómputo ha sido un factor crítico desde que el modelo se abrió a un público más amplio a principios de septiembre.

Según reportes de usuarios, OpenAI ha recortado los límites de uso de Astra para quienes más utilizan ChatGPT y ha pausado nuevas suscripciones Pro de 200 dólares mensuales, una medida que Sottiaux confirmó el 10 de septiembre. El modelo mantiene su precio en 10 dólares por millón de tokens de entrada y 50 dólares por millón de tokens de salida, 2,5 veces más que la tarifa de Sol en su lanzamiento.

Es el segundo buque insignia de OpenAI en dos meses que afronta la misma crítica por parte de clientes de pago. En julio, varios usuarios denunciaron que el modo de razonamiento avanzado de Sol se había vuelto superficial de la noche a la mañana. Sottiaux rechazó haberlo degradado de forma deliberada, pero admitió que la compañía estaba experimentando con distintos niveles de esfuerzo de razonamiento.

Próxima lectura: Jensen Huang, de Nvidia, asegura que las empresas de ciberseguridad se benefician del pánico ante las amenazas de IA

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev es el Jefe de Contenido en Yellow.com y ha informado sobre criptomonedas durante los últimos 10 años. Se especializa en artículos de Investigación y Aprendizaje en profundidad, con un enfoque en reportes analíticos, contexto de la industria y las grandes fuerzas que dan forma al cripto, desde la era de la IA y las tecnologías de seguridad hasta la innovación fintech. Cree que todo lo digital superará inminentemente a todo lo analógico y trabaja arduamente para hacerlo realidad.

Descargo de responsabilidad y advertencia de riesgos: La información proporcionada en este artículo es solo para propósitos educativos e informativos y se basa en la opinión del autor. No constituye asesoramiento financiero, de inversión, legal o fiscal. Los activos de criptomonedas son altamente volátiles y están sujetos a alto riesgo, incluido el riesgo de perder toda o una cantidad sustancial de su inversión. Operar o mantener activos cripto puede no ser adecuado para todos los inversores. Las opiniones expresadas en este artículo son únicamente las del autor/autores y no representan la política oficial o posición de Yellow, sus fundadores o sus ejecutivos. Siempre realice su propia investigación exhaustiva (D.Y.O.R.) y consulte a un profesional financiero licenciado antes de tomar cualquier decisión de inversión.