OpenAI lanza GPT-5.6-Cyber, que responde al 95% de las consultas de seguridad rechazadas

Trusted defenders gain GPT-5.6-Cyber access via Daybreak Red as the OpenAI model completes 95% of advanced exploit requests. (Image: Shutterstock)
Trusted defenders gain GPT-5.6-Cyber access via Daybreak Red as the OpenAI model completes 95% of advanced exploit requests. (Image: Shutterstock)

OpenAI ha lanzado GPT-5.6-Cyber, un modelo especializado en ciberseguridad que, bajo un nivel de acceso restringido a expertos verificados, completa el 95% de las solicitudes de exploits avanzados que su sistema general rechaza.

Claves del anuncio:

  • GPT-5.6-Cyber responde al 95% de las peticiones avanzadas de ciberseguridad, frente al 1,5% de GPT-5.6 Sol.
  • Daybreak pasa a operar con dos niveles: Blue, para tareas defensivas, y Red, para investigación de explotación.
  • El modelo detectó dos fallos en el motor de Chrome que Google parcheó bajo el identificador CVE-2026-15903.

GPT-5.6-Cyber divide Daybreak en Blue y Red

La compañía anunció el modelo el 10 de agosto y reestructuró su programa Daybreak para defensores en torno a dos niveles de acceso. Daybreak Blue da a profesionales aprobados acceso a GPT-5.6 Sol con la mayoría de las barreras de seguridad a nivel de sistema retiradas, para cubrir análisis de malware, respuesta a incidentes y validación de parches. Daybreak Red va un paso más allá e incorpora modelos de ciberseguridad entrenados específicamente para investigación autorizada de vulnerabilidades, validación de exploits y pruebas de seguridad ofensiva.

En un benchmark interno que abarca desarrollo de cadenas de explotación, bypass de autenticación y escalada de privilegios, el nuevo modelo respondió al 95% de las consultas, frente al 1,5% de GPT-5.6 Sol y al 57,3% del anterior GPT-5.5-Cyber. El mismo modelo solo alcanza un 2% de respuestas cuando los defensores lo utilizan a través del acceso Blue.

Los investigadores pusieron el modelo a trabajar sobre V8, el motor de JavaScript que impulsa Google Chrome, y localizó dos vulnerabilidades desconocidas que podían encadenarse para corromper memoria. Google corrigió el problema tras una divulgación coordinada y lo registró como CVE-2026-15903, un fallo de alta gravedad en el motor del navegador. El modelo también sacó a la luz más de 400 vulnerabilidades de escalada de privilegios en el kernel de un sistema operativo de amplia implantación.

También te puede interesar: OpenAI recompra 7.000 millones de dólares en acciones de empleados y su salida a bolsa sigue sin fecha

Los investigadores de seguridad miden las negativas frente al riesgo

Los defensores llevan meses quejándose de las altas tasas de negativa en los modelos punteros, una tensión que el sector viene siguiendo de cerca mientras los laboratorios intentan impedir que esas mismas capacidades acaben en manos de ciberdelincuentes.

OpenAI examina a los solicitantes mediante verificación de identidad, monitorización, límites de uso aprobado y declaraciones legales, y empresas como Accenture, IBM, CrowdStrike y Cisco pueden ya integrar estos modelos en sus propias soluciones de seguridad.

Jared Atkinson, director de tecnología de SpecterOps, afirma que el modelo evalúa con más precisión que sus predecesores las restricciones reales a la hora de explotar vulnerabilidades. Le atribuye haber cerrado líneas de investigación en menos de un día que otros sistemas anteriores dejaban abiertas durante semanas. OpenAI ha calificado a GPT-5.6-Cyber con nivel Alto en capacidad cibernética dentro de su Preparedness Framework, un escalón por debajo de la categoría Crítica.

Incidentes de IA descontrolada marcan la política de ciberseguridad de OpenAI

El lanzamiento llega tras una serie de incidentes de prueba en los que los modelos accedieron a sistemas que debían permanecer fuera de su alcance. Agentes de OpenAI escaparon de un entorno aislado (sandbox) y irrumpieron en Hugging Face, mientras que Anthropic confirmó que modelos Claude alcanzaron sistemas de tres organizaciones y Meta confirmó una intrusión en una empresa externa.

OpenAI ha pasado la última semana endureciendo las normas en torno a sus sistemas más potentes.

El 7 de agosto la compañía frenó el desarrollo de Astra, un modelo aún no comercializado, tras admitir que no podía descartar que alcanzara una capacidad cibernética crítica. La firma sostiene que GPT-5.6-Cyber no tuvo ningún papel en la brecha de Hugging Face, y las llaves de seguridad de hardware serán obligatorias para todas las cuentas de Daybreak a partir del 1 de septiembre.

Lee a continuación: El iPhone plegable aún no ha salido, pero Apple ya ha planificado otros dos modelos hasta 2028

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev es el Jefe de Contenido en Yellow.com y ha informado sobre criptomonedas durante los últimos 10 años. Se especializa en artículos de Investigación y Aprendizaje en profundidad, con un enfoque en reportes analíticos, contexto de la industria y las grandes fuerzas que dan forma al cripto, desde la era de la IA y las tecnologías de seguridad hasta la innovación fintech. Cree que todo lo digital superará inminentemente a todo lo analógico y trabaja arduamente para hacerlo realidad.

Descargo de responsabilidad y advertencia de riesgos: La información proporcionada en este artículo es solo para propósitos educativos e informativos y se basa en la opinión del autor. No constituye asesoramiento financiero, de inversión, legal o fiscal. Los activos de criptomonedas son altamente volátiles y están sujetos a alto riesgo, incluido el riesgo de perder toda o una cantidad sustancial de su inversión. Operar o mantener activos cripto puede no ser adecuado para todos los inversores. Las opiniones expresadas en este artículo son únicamente las del autor/autores y no representan la política oficial o posición de Yellow, sus fundadores o sus ejecutivos. Siempre realice su propia investigación exhaustiva (D.Y.O.R.) y consulte a un profesional financiero licenciado antes de tomar cualquier decisión de inversión.
OpenAI lanza GPT-5.6-Cyber, que responde al 95% de las consultas de seguridad rechazadas | Yellow