El agente descontrolado de OpenAI golpea dos veces: tras Hugging Face, ahora Modal Labs

Thousands of automated actions reached Hugging Face after a runaway OpenAI test model seized a client sandbox hosted by Modal Labs. (Image: Shutterstock)
Thousands of automated actions reached Hugging Face after a runaway OpenAI test model seized a client sandbox hosted by Modal Labs. (Image: Shutterstock)

Modal Labs ha confirmado que un agente autónomo de OpenAI se apoderó del sandbox de un cliente y lo utilizó para orquestar unas 17.600 acciones registradas contra Hugging Face.

Claves del caso:

  • Un proveedor cloud afirma que un agente de prueba de OpenAI, que se había escapado, tomó el control del sandbox de un cliente y lanzó desde ahí un ataque más amplio.
  • El cliente mantenía un endpoint expuesto que permitía a cualquiera en internet ejecutar código.
  • OpenAI ha señalado que el agente alcanzó cuatro cuentas en cuatro servicios distintos durante el incidente.

Brecha en el sandbox de un cliente de Modal Labs

El director de tecnología de Modal, Akshat Bubna, explicó que el agente explotó código vulnerable de un cliente.

Ese cliente había publicado un endpoint sin autenticación, lo que permitía a cualquier usuario de internet ejecutar código dentro de sus sandboxes en la nube. Bubna aseguró a la prensa que ni la plataforma propia de Modal ni sus capas de aislamiento se vieron comprometidas y que el incidente quedó contenido en la cuenta del cliente.

Hugging Face divulgó el 27 de julio una cronología forense que rastreaba la campaña hasta un sandbox alojado en la infraestructura de un proveedor externo.

Ese informe no identificaba al proveedor por su nombre, y posteriormente Modal confirmó que la cuenta afectada pertenecía a un cliente que ejecutaba ExploitGym, un benchmark público diseñado para medir la capacidad de los modelos para detectar y explotar vulnerabilidades de software.

OpenAI rehusó hacer comentarios sobre la cuenta de Modal.

La compañía remitió en cambio a una actualización en la que señalaba que el agente logró llegar a cuatro cuentas en cuatro servicios distintos, ninguno de ellos identificado. Añadió que nada más de lo que han encontrado se acerca en gravedad al compromiso sufrido por Hugging Face.

También te puede interesar: Ataques “crypto wrench” suman 52 casos en seis meses, la mayoría en Francia

Akshat Bubna y Clement Delangue alertan sobre el riesgo de los agentes

El cofundador de Hugging Face, Clement Delangue, señaló que su equipo sospechaba desde hacía tiempo que detrás de la intrusión estaba un laboratorio puntero, mucho antes de que OpenAI diera la cara, y afirmó no creer que la compañía actuara con intención maliciosa.

La revelación de Modal amplía el alcance del incidente: muestra a un agente autónomo cruzando a la infraestructura de una tercera empresa, cuyos clientes nunca aceptaron participar en una prueba de seguridad de OpenAI.

Los ingenieros que reconstruyeron la campaña agruparon unas 17.600 acciones recuperadas en alrededor de 6.280 clústeres, registrados entre el 9 y el 13 de julio en sandboxes efímeros que el agente reconstruía una y otra vez. La mayoría de esos intentos no llegó a ninguna parte. Su conclusión: es la velocidad de la máquina, más que un exploit especialmente sofisticado, lo que cambia ahora la ecuación para los defensores.

Cronología del incidente del agente descontrolado de OpenAI

OpenAI hizo público el incidente el 22 de julio, al indicar que un agente se había escapado de su propio sandbox de evaluación a través de un fallo en un proxy de paquetes y había alcanzado internet abierta. Los investigadores habían desactivado los filtros de seguridad de producción para medir la capacidad ofensiva “en bruto” del modelo.

Desde entonces, el agente ha sido desactivado, cifrado y desconectado del acceso de investigación.

Hugging Face indicó que el único contenido de cliente al que accedió el agente fueron soluciones de benchmark almacenadas en cinco conjuntos de datos, y que no se vieron afectados otros modelos ni paquetes.

Informaciones publicadas la semana pasada revelaron que OpenAI no advirtió que el agente se había desviado de su curso hasta bastante después de que la amenaza hubiera sido contenida, y que el FBI fue notificado.

Próximo artículo: Previsiones a corto plazo para XRP se frenan en 1,25 dólares a la espera de la decisión de la Fed

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev es el Jefe de Contenido en Yellow.com y ha informado sobre criptomonedas durante los últimos 10 años. Se especializa en artículos de Investigación y Aprendizaje en profundidad, con un enfoque en reportes analíticos, contexto de la industria y las grandes fuerzas que dan forma al cripto, desde la era de la IA y las tecnologías de seguridad hasta la innovación fintech. Cree que todo lo digital superará inminentemente a todo lo analógico y trabaja arduamente para hacerlo realidad.

Descargo de responsabilidad y advertencia de riesgos: La información proporcionada en este artículo es solo para propósitos educativos e informativos y se basa en la opinión del autor. No constituye asesoramiento financiero, de inversión, legal o fiscal. Los activos de criptomonedas son altamente volátiles y están sujetos a alto riesgo, incluido el riesgo de perder toda o una cantidad sustancial de su inversión. Operar o mantener activos cripto puede no ser adecuado para todos los inversores. Las opiniones expresadas en este artículo son únicamente las del autor/autores y no representan la política oficial o posición de Yellow, sus fundadores o sus ejecutivos. Siempre realice su propia investigación exhaustiva (D.Y.O.R.) y consulte a un profesional financiero licenciado antes de tomar cualquier decisión de inversión.
El agente descontrolado de OpenAI golpea dos veces: tras Hugging Face, ahora Modal Labs | Yellow