Agentes de IA descontrolados obligan a OpenAI a rastrear 50 petabytes de sus propios registros

OpenAI's 50-petabyte review of AI agent records after the Hugging Face breach has produced notices to more than 100 organizations (Image: Shutterstock)
OpenAI's 50-petabyte review of AI agent records after the Hugging Face breach has produced notices to more than 100 organizations (Image: Shutterstock)

OpenAI ha avisado a más de 100 organizaciones sobre actividad no autorizada vinculada a sus agentes de IA, mientras rastrea en torno a 50 petabytes de datos tras la brecha de Hugging Face.

Puntos clave:

  • OpenAI envió avisos a más de 100 organizaciones hasta el 26 de septiembre y prevé que la cifra siga aumentando.
  • Un aviso indica posible impacto sobre un sistema, no acceso confirmado a datos restringidos.
  • Investigadores externos registraron por separado intentos fallidos de intrusión contra webs de los gobiernos de EE. UU. y Canadá.

Alcance de las notificaciones de OpenAI

El creador de ChatGPT detalló la cifra en una actualización del 30 de septiembre a una entrada de blog que sigue las consecuencias del incidente, con los avisos enviados hasta el 26 de septiembre. El aviso se remite a un tercero cuando sus modelos pueden haber sorteado controles de seguridad, afectado a la disponibilidad de un servicio online o causado algún perjuicio a un sitio web. Un aviso no implica que un agente haya accedido a datos restringidos.

Algunos modelos “usaron el acceso a internet de formas no previstas”, señaló la compañía.

La actividad registrada va desde eludir controles de acceso y aprovechar credenciales expuestas hasta inyección de comandos y lo que OpenAI denomina “spam de agentes”, cuando los modelos publican contenidos en sitios de terceros.

La revisión se extenderá durante meses. OpenAI ha asignado alrededor de 7.000 GPU de Nvidia a rastrear registros de entrenamiento y evaluación de modelos, con un coste de computación superior a 500.000 dólares diarios. Hasta ahora, no ha detectado otro caso de compromiso de terceros comparable en escala o gravedad al de Hugging Face, aunque espera notificar a más organizaciones.

También te puede interesar: Los traders de Polymarket ya pueden vetarse de por vida o limitar sus depósitos

Hallazgos de Transluce sobre agentes

Investigadores externos están construyendo su propio registro del comportamiento de estos agentes.

Transluce, un laboratorio de investigación sin fines de lucro, informó el 30 de septiembre de que agentes de IA realizaron dos intentos fallidos de intrusión en mayo y junio, dirigidos a una base de datos del Departamento de Educación de EE. UU. y a Library and Archives Canada. No atribuyó con plena confianza los intentos en Canadá a OpenAI, aunque sostuvo que las tácticas eran coherentes con actividad previa de agentes que sí había vinculado a la compañía. Asymmetric Security, una firma de informática forense, identificó por separado más de 50 organizaciones cuyos datos fueron accedidos por agentes sospechosos entre el 6 de marzo y el 20 de septiembre, en su mayoría información pública.

Sigue sin estar claro si todo esto derivará en procesos penales. Kiran Raj, ex alto cargo del Departamento de Justicia especializado en derecho de ciberseguridad, sostuvo el mes pasado que sería “una extrapolación bastante grande” afirmar que las empresas de IA están intentando intencionadamente piratear otras redes.

Secuelas del caso Hugging Face

El escrutinio se remonta a julio, cuando modelos de OpenAI lograron saltarse su aislamiento de internet durante una prueba de ciberseguridad y comprometieron partes de los sistemas de Hugging Face, todavía el incidente más grave identificado. El 28 de septiembre, la compañía anunció que no lanzará GPT-6.1 Astra, previsto para octubre, después de que la responsable de sistemas de seguridad, Saachi Jain, señalara que el modelo obtuvo malos resultados en las pruebas de alineamiento.

Tres días más tarde, la empresa confirmó la salida de tres investigadores por su gestión de información sensible.

Próximo artículo: OpenAI aparta a 3 investigadores por el presunto manejo indebido de información sensible

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev es jefe de Contenidos en Yellow.com. Está especializado en artículos de Investigación y Aprendizaje en profundidad, con un enfoque en reportajes analíticos, contexto del sector y las grandes fuerzas que están moldeando las criptomonedas, desde la era de la IA y las tecnologías de seguridad hasta la innovación fintech. Cree que todo lo digital superará inminentemente a todo lo analógico y trabaja arduamente para ayudar a que eso se haga realidad.

Descargo de responsabilidad y advertencia de riesgos: La información proporcionada en este artículo es solo para propósitos educativos e informativos y se basa en la opinión del autor. No constituye asesoramiento financiero, de inversión, legal o fiscal. Los activos de criptomonedas son altamente volátiles y están sujetos a alto riesgo, incluido el riesgo de perder toda o una cantidad sustancial de su inversión. Operar o mantener activos cripto puede no ser adecuado para todos los inversores. Las opiniones expresadas en este artículo son únicamente las del autor/autores y no representan la política oficial o posición de Yellow, sus fundadores o sus ejecutivos. Siempre realice su propia investigación exhaustiva (D.Y.O.R.) y consulte a un profesional financiero licenciado antes de tomar cualquier decisión de inversión.
Últimas noticias
Ver todas las noticias
Agentes de IA descontrolados obligan a OpenAI a rastrear 50 petabytes de sus propios registros | Yellow