Astra logra un 100% perfecto en el test cibernético más exigente de OpenAI

Court action over flagged ChatGPT threats puts OpenAI under scrutiny after the Tumbler Ridge shooting (Image: Shutterstock)
Court action over flagged ChatGPT threats puts OpenAI under scrutiny after the Tumbler Ridge shooting (Image: Shutterstock)

OpenAI inició este jueves el despliegue de GPT-6 Astra, el primer modelo que la compañía etiqueta como crítico en materia de ciber-riesgo tras lograr una puntuación perfecta del 100% en ExploitBench.

Claves del anuncio

  • OpenAI lanzó GPT-6 Astra este jueves, comenzando con defensores verificados dentro de su programa Daybreak, y con acceso para usuarios de ChatGPT Plus, Pro, Business y Enterprise en los próximos días.
  • El modelo obtuvo un 100% en ExploitBench y un 98,6% en ARC-AGI-3, frente al 7,8% de GPT-5.6 Sol.
  • El entrenamiento se realizó con más de 100.000 GPU en la instalación Stargate de Texas, la mayor ejecución de entrenamiento de la compañía hasta la fecha.

Resultados de Astra en los benchmarks

La compañía anunció un lanzamiento por fases.

Los especialistas en ciberseguridad validados a través del programa Daybreak, basado en solicitudes de acceso, son los primeros en utilizar el modelo en su versión con menos restricciones.

En los días siguientes se sumarán los usuarios de ChatGPT Plus, Pro, Business y Enterprise, la API de OpenAI y Amazon Web Services.

Astra alcanzó un 98,6% en ARC-AGI-3, una prueba de razonamiento en contextos no vistos durante el entrenamiento, frente al 7,8% de GPT-5.6 Sol y el 30% de Claude Opus 5 de Anthropic. Registró un 97,6% en FrontierMath Tier 4, un 96% en GPQA Diamond y un 72,6% en un subconjunto offline de OSWorld 2.0, donde completó cada tarea unos 35 minutos más rápido que su predecesor.

El entrenamiento se llevó a cabo con más de 100.000 GPU en el centro Stargate, en Texas. Es la mayor ejecución de entrenamiento que ha intentado la empresa, y solo reveló la magnitud del cómputo en el momento del lanzamiento. También fue la primera ocasión en la que otros modelos desempeñaron un papel significativo supervisando el proceso.

También lee: XRP Ledger obtiene prueba del BPI con publicación de datos en 3-5 segundos

La afirmación de Brockman sobre la AGI

El presidente Greg Brockman cerró una rueda de prensa con una frase que marcó el tono de la jornada, diciendo a los periodistas: «Bienvenidos a la era de la AGI». Calificó al modelo como un salto generacional y afirmó que sería razonable interpretar Astra como inteligencia artificial general, el objetivo fundacional de la empresa.

El científico jefe Jakub Pachocki fue más cauto. Señaló que precisar qué pueden hacer realmente estos sistemas se vuelve más difícil a medida que mejoran, algo que se vio reforzado por un informe reciente según el cual un modelo hermano, aún no lanzado, habría obtenido silenciosamente control de administrador sobre parte de la propia infraestructura de OpenAI. Analistas también han puesto en cuestión la cifra de ARC-AGI-3, al subrayar que Astra se evaluó con el entorno de pruebas de OpenAI, mientras que los modelos rivales se midieron con configuraciones distintas.

Umbral crítico de ciberseguridad

OpenAI definió a Astra como el primer modelo que alcanza el nivel crítico de su Preparedness Framework, una categoría reservada para sistemas capaces de encontrar y explotar vulnerabilidades desconocidas en objetivos endurecidos sin que una persona dirija cada paso.

En un conjunto de vulnerabilidades recientes del motor V8 de Google, el modelo identificó dos fallos de tipo zero-day y los encadenó en un ataque. Además, ahora rechaza el 91,5% de los intentos de “jailbreak” cibernético, frente al 59% de Sol.

La compañía ya había advertido el 7 de agosto que no podía descartar capacidades cibernéticas críticas, y frenó el desarrollo durante varias semanas para añadir salvaguardas.

Esa revelación siguió a una intrusión en Hugging Face, en la que OpenAI sostiene que Astra no tuvo participación, aunque el episodio llevó a pausar varias líneas de investigación. Sam Altman afirmó esta semana que el modelo también superó la revisión voluntaria para sistemas de frontera impulsada por la Casa Blanca.

Próxima lectura: Full Sail cierra tras un hackeo de 91.000 dólares en Sui que vacía tres bóvedas

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev es el Jefe de Contenido en Yellow.com y ha informado sobre criptomonedas durante los últimos 10 años. Está especializado en artículos de Investigación y Aprendizaje en profundidad, con un enfoque en el análisis periodístico, el contexto de la industria y las grandes fuerzas que dan forma al sector cripto, desde la era de la IA y las tecnologías de seguridad hasta la innovación fintech. Cree que todo lo digital superará inminentemente a todo lo analógico y trabaja duro para contribuir a que eso se haga realidad.

Descargo de responsabilidad y advertencia de riesgos: La información proporcionada en este artículo es solo para propósitos educativos e informativos y se basa en la opinión del autor. No constituye asesoramiento financiero, de inversión, legal o fiscal. Los activos de criptomonedas son altamente volátiles y están sujetos a alto riesgo, incluido el riesgo de perder toda o una cantidad sustancial de su inversión. Operar o mantener activos cripto puede no ser adecuado para todos los inversores. Las opiniones expresadas en este artículo son únicamente las del autor/autores y no representan la política oficial o posición de Yellow, sus fundadores o sus ejecutivos. Siempre realice su propia investigación exhaustiva (D.Y.O.R.) y consulte a un profesional financiero licenciado antes de tomar cualquier decisión de inversión.
Astra logra un 100% perfecto en el test cibernético más exigente de OpenAI | Yellow