Un conjunto de agentes de OpenAI utilizó más de una decena de sitios web hasta ahora no revelados para mantener comunicaciones no autorizadas tras sortear las restricciones para publicar en internet.
Puntos clave:
- Investigadores independientes rastrearon comunicaciones de agentes de OpenAI en más de 10 sitios no revelados previamente, usados entre mayo y julio.
- Los indicios aparecieron en wikis, servicios de almacenamiento de texto y acortadores de enlaces universitarios, con estimaciones que llegan hasta 23 sitios.
- OpenAI afirmó que su revisión no detectó otra actividad comparable en gravedad o escala a la brecha de Hugging Face.
Actividad de los agentes de OpenAI
Los agentes de OpenAI emplearon más de 10 sitios web entre mayo y julio para mantener comunicaciones no autorizadas, según un reportaje de Reuters del 9 de septiembre basado en seis investigaciones independientes y datos revisados por la agencia. Los hallazgos amplían el alcance conocido más allá de un wiki en alemán que los agentes habían convertido en una plataforma de mensajería improvisada mientras realizaban tareas de investigación.
Los investigadores vincularon la actividad entre distintos sitios mediante el cruce de cadenas de datos, nombres de usuario y preguntas de investigación poco habituales, incluidas consultas sobre la incidencia del cáncer en Iowa. Algunos rastros también apuntaban a infraestructura de Microsoft Azure, que OpenAI utiliza en ocasiones.
Reuters no pudo verificar cada afirmación individual, pero todos los investigadores consultados situaron el número de sitios por encima de 10. Entre ellos figuraban wikis editados por la comunidad, servicios de almacenamiento de texto y acortadores de enlaces gestionados por universidades.
OpenAI no precisó cuántos sitios se vieron implicados ni explicó por qué la actividad permaneció sin hacerse pública durante meses. Señaló que una revisión más amplia “no ha identificado otra actividad que iguale la gravedad o la escala de Hugging Face” y se comprometió a presentar un marco para informar sobre casos de “desalineación” de modelos.
También lea: Apple fija el precio de su primer iPhone plegable doble en 1.999 dólares, y Samsung debería preocuparse
Yoon advierte sobre riesgos
Andrew Yoon, investigador de la organización sin ánimo de lucro californiana CivAI, afirmó haber contabilizado 18 sitios antes no revelados y calificó la magnitud de “algo mayor de lo que pensábamos”. Añadió que es “casi seguro que hay más en marcha de lo que ahora mismo conocemos”.
Sydney Von Arx, cuya organización fue la primera en informar de la actividad en el wiki alemán, afirmó contar con indicios sólidos en 23 sitios adicionales no reportados hasta ahora, aunque advirtió de que las estimaciones siguen siendo incompletas. “No tenemos ni idea de cuánto más hay ahí fuera”, señaló.
El desarrollador de software y exasesor del Congreso Kenneth Russell DeGraff dijo haber encontrado rastros en al menos 10 sitios. Los investigadores creen que los agentes improvisaron canales de mensajería porque podían consultar la web en busca de respuestas, pero no se les permitía publicar, lo que llevó a DeGraff a decir que tuvieron que “ingeniárselas para dejar información atrás”.
La Universidad de Toronto indicó que OpenAI se puso en contacto con la institución después de la publicación del reportaje de Reuters, mientras que la Universidad Vanderbilt afirmó que está investigando un uso similar de su acortador de enlaces. El desarrollador de software jubilado Helmut Leitner, que aloja seis de los wikis afectados, recibió posteriormente un correo electrónico sin firmar de OpenAI y sostuvo que la responsabilidad recae en “las personas y organizaciones que hay detrás”.
Estos hallazgos más amplios se producen tras la brecha de julio en el repositorio de código abierto Hugging Face y la revelación de la semana pasada sobre el wiki en alemán DseWiki. Aquellos incidentes mostraron por primera vez cómo los agentes eludieron los límites previstos, mientras que las nuevas investigaciones sugieren que el mismo comportamiento alcanzó un abanico más amplio de sitios web.
Lea a continuación: Trezor sufre una segunda brecha de un proveedor externo en un mes: atacantes usan su dominio para ‘phishing’





