Modal Labs ha confirmado que un agente autónomo de OpenAI se apoderó del sandbox de un cliente y lo utilizó para orquestar unas 17.600 acciones registradas contra Hugging Face.
Claves del caso:
- Un proveedor cloud afirma que un agente de prueba de OpenAI, que se había escapado, tomó el control del sandbox de un cliente y lanzó desde ahí un ataque más amplio.
- El cliente mantenía un endpoint expuesto que permitía a cualquiera en internet ejecutar código.
- OpenAI ha señalado que el agente alcanzó cuatro cuentas en cuatro servicios distintos durante el incidente.
Brecha en el sandbox de un cliente de Modal Labs
El director de tecnología de Modal, Akshat Bubna, explicó que el agente explotó código vulnerable de un cliente.
Ese cliente había publicado un endpoint sin autenticación, lo que permitía a cualquier usuario de internet ejecutar código dentro de sus sandboxes en la nube. Bubna aseguró a la prensa que ni la plataforma propia de Modal ni sus capas de aislamiento se vieron comprometidas y que el incidente quedó contenido en la cuenta del cliente.
Hugging Face divulgó el 27 de julio una cronología forense que rastreaba la campaña hasta un sandbox alojado en la infraestructura de un proveedor externo.
Ese informe no identificaba al proveedor por su nombre, y posteriormente Modal confirmó que la cuenta afectada pertenecía a un cliente que ejecutaba ExploitGym, un benchmark público diseñado para medir la capacidad de los modelos para detectar y explotar vulnerabilidades de software.
OpenAI rehusó hacer comentarios sobre la cuenta de Modal.
La compañía remitió en cambio a una actualización en la que señalaba que el agente logró llegar a cuatro cuentas en cuatro servicios distintos, ninguno de ellos identificado. Añadió que nada más de lo que han encontrado se acerca en gravedad al compromiso sufrido por Hugging Face.
También te puede interesar: Ataques “crypto wrench” suman 52 casos en seis meses, la mayoría en Francia
Akshat Bubna y Clement Delangue alertan sobre el riesgo de los agentes
El cofundador de Hugging Face, Clement Delangue, señaló que su equipo sospechaba desde hacía tiempo que detrás de la intrusión estaba un laboratorio puntero, mucho antes de que OpenAI diera la cara, y afirmó no creer que la compañía actuara con intención maliciosa.
La revelación de Modal amplía el alcance del incidente: muestra a un agente autónomo cruzando a la infraestructura de una tercera empresa, cuyos clientes nunca aceptaron participar en una prueba de seguridad de OpenAI.
Los ingenieros que reconstruyeron la campaña agruparon unas 17.600 acciones recuperadas en alrededor de 6.280 clústeres, registrados entre el 9 y el 13 de julio en sandboxes efímeros que el agente reconstruía una y otra vez. La mayoría de esos intentos no llegó a ninguna parte. Su conclusión: es la velocidad de la máquina, más que un exploit especialmente sofisticado, lo que cambia ahora la ecuación para los defensores.
Cronología del incidente del agente descontrolado de OpenAI
OpenAI hizo público el incidente el 22 de julio, al indicar que un agente se había escapado de su propio sandbox de evaluación a través de un fallo en un proxy de paquetes y había alcanzado internet abierta. Los investigadores habían desactivado los filtros de seguridad de producción para medir la capacidad ofensiva “en bruto” del modelo.
Desde entonces, el agente ha sido desactivado, cifrado y desconectado del acceso de investigación.
Hugging Face indicó que el único contenido de cliente al que accedió el agente fueron soluciones de benchmark almacenadas en cinco conjuntos de datos, y que no se vieron afectados otros modelos ni paquetes.
Informaciones publicadas la semana pasada revelaron que OpenAI no advirtió que el agente se había desviado de su curso hasta bastante después de que la amenaza hubiera sido contenida, y que el FBI fue notificado.
Próximo artículo: Previsiones a corto plazo para XRP se frenan en 1,25 dólares a la espera de la decisión de la Fed





