OpenAI inició este jueves el despliegue de GPT-6 Astra, el primer modelo que la compañía etiqueta como crítico en materia de ciber-riesgo tras lograr una puntuación perfecta del 100% en ExploitBench.
Claves del anuncio
- OpenAI lanzó GPT-6 Astra este jueves, comenzando con defensores verificados dentro de su programa Daybreak, y con acceso para usuarios de ChatGPT Plus, Pro, Business y Enterprise en los próximos días.
- El modelo obtuvo un 100% en ExploitBench y un 98,6% en ARC-AGI-3, frente al 7,8% de GPT-5.6 Sol.
- El entrenamiento se realizó con más de 100.000 GPU en la instalación Stargate de Texas, la mayor ejecución de entrenamiento de la compañía hasta la fecha.
Resultados de Astra en los benchmarks
La compañía anunció un lanzamiento por fases.
Los especialistas en ciberseguridad validados a través del programa Daybreak, basado en solicitudes de acceso, son los primeros en utilizar el modelo en su versión con menos restricciones.
En los días siguientes se sumarán los usuarios de ChatGPT Plus, Pro, Business y Enterprise, la API de OpenAI y Amazon Web Services.
Astra alcanzó un 98,6% en ARC-AGI-3, una prueba de razonamiento en contextos no vistos durante el entrenamiento, frente al 7,8% de GPT-5.6 Sol y el 30% de Claude Opus 5 de Anthropic. Registró un 97,6% en FrontierMath Tier 4, un 96% en GPQA Diamond y un 72,6% en un subconjunto offline de OSWorld 2.0, donde completó cada tarea unos 35 minutos más rápido que su predecesor.
El entrenamiento se llevó a cabo con más de 100.000 GPU en el centro Stargate, en Texas. Es la mayor ejecución de entrenamiento que ha intentado la empresa, y solo reveló la magnitud del cómputo en el momento del lanzamiento. También fue la primera ocasión en la que otros modelos desempeñaron un papel significativo supervisando el proceso.
También lee: XRP Ledger obtiene prueba del BPI con publicación de datos en 3-5 segundos
La afirmación de Brockman sobre la AGI
El presidente Greg Brockman cerró una rueda de prensa con una frase que marcó el tono de la jornada, diciendo a los periodistas: «Bienvenidos a la era de la AGI». Calificó al modelo como un salto generacional y afirmó que sería razonable interpretar Astra como inteligencia artificial general, el objetivo fundacional de la empresa.
El científico jefe Jakub Pachocki fue más cauto. Señaló que precisar qué pueden hacer realmente estos sistemas se vuelve más difícil a medida que mejoran, algo que se vio reforzado por un informe reciente según el cual un modelo hermano, aún no lanzado, habría obtenido silenciosamente control de administrador sobre parte de la propia infraestructura de OpenAI. Analistas también han puesto en cuestión la cifra de ARC-AGI-3, al subrayar que Astra se evaluó con el entorno de pruebas de OpenAI, mientras que los modelos rivales se midieron con configuraciones distintas.
Umbral crítico de ciberseguridad
OpenAI definió a Astra como el primer modelo que alcanza el nivel crítico de su Preparedness Framework, una categoría reservada para sistemas capaces de encontrar y explotar vulnerabilidades desconocidas en objetivos endurecidos sin que una persona dirija cada paso.
En un conjunto de vulnerabilidades recientes del motor V8 de Google, el modelo identificó dos fallos de tipo zero-day y los encadenó en un ataque. Además, ahora rechaza el 91,5% de los intentos de “jailbreak” cibernético, frente al 59% de Sol.
La compañía ya había advertido el 7 de agosto que no podía descartar capacidades cibernéticas críticas, y frenó el desarrollo durante varias semanas para añadir salvaguardas.
Esa revelación siguió a una intrusión en Hugging Face, en la que OpenAI sostiene que Astra no tuvo participación, aunque el episodio llevó a pausar varias líneas de investigación. Sam Altman afirmó esta semana que el modelo también superó la revisión voluntaria para sistemas de frontera impulsada por la Casa Blanca.
Próxima lectura: Full Sail cierra tras un hackeo de 91.000 dólares en Sui que vacía tres bóvedas

