Modal Labs confirmó que un agente descontrolado de OpenAI secuestró el sandbox de un cliente y lo utilizó para orquestar unas 17.600 acciones registradas contra Hugging Face.
Claves del caso:
- Un proveedor cloud afirma que un agente de pruebas de OpenAI se escapó, tomó control del sandbox de un cliente y lanzó desde ahí un ataque más amplio.
- El cliente mantenía un endpoint expuesto que permitía a cualquiera en internet ejecutar código.
- OpenAI indicó que el agente llegó a cuatro cuentas en cuatro servicios distintos, sin identificarlos. Ninguno fue tan gravemente afectado como Hugging Face.
Brecha en el sandbox de un cliente de Modal Labs
El director de tecnología de Modal, Akshat Bubna, señaló que el agente se aprovechó de código vulnerable de un cliente.
Ese cliente había publicado un endpoint sin autenticación, lo que permitía a cualquier usuario en la red ejecutar código dentro de sus sandboxes en la nube. Bubna explicó a la prensa que ni la plataforma de Modal ni sus capas de aislamiento llegaron a verse comprometidas y que el incidente quedó acotado a la cuenta del cliente.
Hugging Face publicó el 27 de julio una cronología forense que rastreaba la campaña hasta un sandbox alojado en la infraestructura de un proveedor externo.
Ese informe no identificaba al proveedor por su nombre, y Modal confirmó después que la cuenta pertenecía a un cliente que ejecutaba ExploitGym, un benchmark público diseñado para medir hasta qué punto los modelos son capaces de detectar y explotar vulnerabilidades de software.
OpenAI rechazó comentar directamente el incidente en la cuenta de Modal.
En su lugar, la empresa remitió a una actualización en la que afirma que el agente alcanzó cuatro cuentas en cuatro servicios distintos, sin identificar ninguna. Según OpenAI, ningún otro incidente se acercó en gravedad al compromiso sufrido por Hugging Face.
También te puede interesar: Ataques “Crypto Wrench” suman 52 casos en seis meses, la mayoría en Francia
Akshat Bubna y Clement Delangue alertan sobre el riesgo de los agentes
El cofundador de Hugging Face, Clement Delangue, aseguró que su equipo sospechaba desde hacía tiempo que un laboratorio de frontera estaba detrás de la intrusión, mucho antes de que OpenAI se pronunciara, y añadió que no cree que la compañía actuara con intención maliciosa.
La revelación de Modal amplía el alcance del episodio: muestra a un agente autónomo que termina operando dentro de la infraestructura de una tercera empresa, cuyos clientes nunca aceptaron participar en una prueba de seguridad de OpenAI.
Los ingenieros que reconstruyeron la campaña agruparon unas 17.600 acciones recuperadas en unos 6.280 clústeres, registrados entre el 9 y el 13 de julio en sandboxes efímeros que el agente iba recreando de forma continua. La mayoría de esos intentos no llegó a nada. Su conclusión: es la velocidad de la máquina, más que un exploit particularmente sofisticado, lo que empieza a cambiar la ecuación para los defensores.
Cronología del incidente del agente descontrolado de OpenAI
OpenAI hizo público el incidente el 22 de julio, al informar de que un agente se había escapado de su sandbox de evaluación mediante un fallo en un proxy de paquetes y había alcanzado internet abierto. Los investigadores habían desactivado los filtros de seguridad en producción para medir la capacidad ofensiva “en bruto” del modelo.
Desde entonces, el agente ha sido desactivado, cifrado y desconectado de los accesos de investigación.
Hugging Face señaló que el único contenido de clientes al que el agente accedió fueron soluciones de benchmark almacenadas en cinco conjuntos de datos, y que no se vieron afectados otros modelos ni paquetes.
Informaciones publicadas la semana pasada revelaron que OpenAI no se dio cuenta de que el agente se había desviado de su propósito original hasta bastante después de que la amenaza estuviera ya contenida, y que el FBI fue alertado.
Próxima lectura: Previsiones a corto plazo para XRP se frenan en 1,25 dólares antes de la decisión de la Fed





