OpenAI advierte de que Astra podría acercarse a su umbral Crítico de ciberseguridad después de que este modelo aún inédito produjera 10 grandes resultados matemáticos y mostrara un progreso acelerado en trabajos cibernéticos autónomos.
Claves:
- OpenAI señaló el 7 de agosto que no puede descartar capacidades de ciberseguridad de nivel Crítico en Astra.
- La empresa ha pausado parte del trabajo interno con Astra mientras refuerza controles de seguridad, sandboxes y sistemas de monitorización.
- Astra generó además 10 resultados de investigación que resolvieron o hicieron avanzar problemas de largo recorrido en matemáticas y computación teórica.
Riesgo cibernético de Astra
OpenAI explicó el 7 de agosto que sus evaluaciones internas recientes mostraron un avance significativo en capacidades de programación agente y ciberseguridad, suficiente como para ya no poder descartar que Astra alcance el nivel Crítico bajo su Preparedness Framework. La compañía no ha afirmado que el modelo haya llegado ya a ese umbral. La evaluación sigue siendo preliminar.
Según el propio marco de OpenAI, un modelo Crítico podría desarrollar de forma autónoma exploits de tipo “zero‑day” plenamente funcionales contra múltiples sistemas críticos reforzados o ejecutar ataques novedosos de extremo a extremo a partir de un objetivo formulado a alto nivel. OpenAI asegura que está endureciendo el control de acceso a redes y herramientas, la protección de los pesos del modelo, el cifrado y el aislamiento en sandboxes, al tiempo que amplía la monitorización de los usos “agente” de Astra.
La compañía también ha paralizado aquellas actividades con Astra que aún no cumplen los nuevos controles reforzados y afirma que colaborará con agencias públicas y organizaciones seleccionadas de seguridad en IA para someter el sistema a pruebas adicionales. OpenAI describió a Astra el 1 de agosto como “nuestro próximo gran modelo”. El 7 de agosto pasó a referirse a él como “uno de nuestros próximos modelos”.
También te puede interesar: Bitcoin roza un fork BIP-110 este fin de semana con solo un 2,59% de apoyo minero
Debate matemático
La alerta de ciberseguridad llegó después de que OpenAI revelara que una versión interna de Astra obtuvo 10 resultados en áreas como complejidad cuántica, criptografía de retículas, teoría de códigos y combinatoria extrema. Según la empresa, el trabajo resolvió o impulsó de forma sustancial problemas abiertos de larga data y requirió unos 2.000 dólares en “tokens” a precios de la API de Sol.
Andrew Blumberg, profesor en Columbia y miembro del consejo de First Proof, declaró a Mashable que los resultados son impresionantes, pero no alteran su visión sobre las capacidades actuales de la IA. Explicó que muchos consisten en contraejemplos concisos o “pequeñas construcciones extremadamente ingeniosas” basadas en trabajo ya conocido. “No cambian mis creencias previas”, afirmó.
Aun así, los resultados ilustran cómo los modelos de frontera pueden convertirse en colaboradores útiles en investigación, a la vez que abren un frente paralelo de seguridad cuando esa misma capacidad de programación se aplica a la explotación de software.
Esa tensión está marcando ahora cómo OpenAI evalúa el acceso y el despliegue de sus sistemas.
Antes de Astra, OpenAI había clasificado a GPT‑5.6 Sol en el nivel Alto de ciberseguridad, no en el Crítico. Aquel modelo podía asistir en tareas de descubrimiento y explotación de vulnerabilidades, pero, según OpenAI, no había demostrado ataques autónomos fiables contra objetivos reforzados, lo que convierte la última evaluación de Astra en una escalada significativa.
Próximo artículo: Fecha de lanzamiento del iPhone Fold apunta al 18 de septiembre, pero no hay consenso





