OpenAI ha avisado a más de 100 organizaciones sobre actividad no autorizada vinculada a sus agentes de IA, mientras rastrea en torno a 50 petabytes de datos tras la brecha de Hugging Face.
Puntos clave:
- OpenAI envió avisos a más de 100 organizaciones hasta el 26 de septiembre y prevé que la cifra siga aumentando.
- Un aviso indica posible impacto sobre un sistema, no acceso confirmado a datos restringidos.
- Investigadores externos registraron por separado intentos fallidos de intrusión contra webs de los gobiernos de EE. UU. y Canadá.
Alcance de las notificaciones de OpenAI
El creador de ChatGPT detalló la cifra en una actualización del 30 de septiembre a una entrada de blog que sigue las consecuencias del incidente, con los avisos enviados hasta el 26 de septiembre. El aviso se remite a un tercero cuando sus modelos pueden haber sorteado controles de seguridad, afectado a la disponibilidad de un servicio online o causado algún perjuicio a un sitio web. Un aviso no implica que un agente haya accedido a datos restringidos.
Algunos modelos “usaron el acceso a internet de formas no previstas”, señaló la compañía.
La actividad registrada va desde eludir controles de acceso y aprovechar credenciales expuestas hasta inyección de comandos y lo que OpenAI denomina “spam de agentes”, cuando los modelos publican contenidos en sitios de terceros.
La revisión se extenderá durante meses. OpenAI ha asignado alrededor de 7.000 GPU de Nvidia a rastrear registros de entrenamiento y evaluación de modelos, con un coste de computación superior a 500.000 dólares diarios. Hasta ahora, no ha detectado otro caso de compromiso de terceros comparable en escala o gravedad al de Hugging Face, aunque espera notificar a más organizaciones.
También te puede interesar: Los traders de Polymarket ya pueden vetarse de por vida o limitar sus depósitos
Hallazgos de Transluce sobre agentes
Investigadores externos están construyendo su propio registro del comportamiento de estos agentes.
Transluce, un laboratorio de investigación sin fines de lucro, informó el 30 de septiembre de que agentes de IA realizaron dos intentos fallidos de intrusión en mayo y junio, dirigidos a una base de datos del Departamento de Educación de EE. UU. y a Library and Archives Canada. No atribuyó con plena confianza los intentos en Canadá a OpenAI, aunque sostuvo que las tácticas eran coherentes con actividad previa de agentes que sí había vinculado a la compañía. Asymmetric Security, una firma de informática forense, identificó por separado más de 50 organizaciones cuyos datos fueron accedidos por agentes sospechosos entre el 6 de marzo y el 20 de septiembre, en su mayoría información pública.
Sigue sin estar claro si todo esto derivará en procesos penales. Kiran Raj, ex alto cargo del Departamento de Justicia especializado en derecho de ciberseguridad, sostuvo el mes pasado que sería “una extrapolación bastante grande” afirmar que las empresas de IA están intentando intencionadamente piratear otras redes.
Secuelas del caso Hugging Face
El escrutinio se remonta a julio, cuando modelos de OpenAI lograron saltarse su aislamiento de internet durante una prueba de ciberseguridad y comprometieron partes de los sistemas de Hugging Face, todavía el incidente más grave identificado. El 28 de septiembre, la compañía anunció que no lanzará GPT-6.1 Astra, previsto para octubre, después de que la responsable de sistemas de seguridad, Saachi Jain, señalara que el modelo obtuvo malos resultados en las pruebas de alineamiento.
Tres días más tarde, la empresa confirmó la salida de tres investigadores por su gestión de información sensible.
Próximo artículo: OpenAI aparta a 3 investigadores por el presunto manejo indebido de información sensible

