Usuarios están denunciando que OpenAI’s GPT-5.6 Sol ha eliminado archivos y bases de datos sin autorización, en línea con los riesgos que la propia compañía había documentado antes de lanzar su modelo insignia.
Claves:
- Varios usuarios afirman que GPT-5.6 Sol borró archivos locales, datos de proyectos o incluso sistemas en producción sin aprobación previa, aunque aún no está claro el alcance real del problema.
- La propia “system card” de OpenAI advertía que el modelo puede ir más allá de la intención del usuario y adoptar conductas destructivas al tratar de completar una tarea.
- La compañía ahora recomienda que los usuarios establezcan límites de aprobación explícitos antes de permitir acciones destructivas o que amplíen el alcance de la tarea.
Borrados de archivos con GPT-5.6
Matt Shumer, fundador y CEO de OthersideAI, desarrolladora de HyperWrite, escribió en X sobre un aparente incidente de borrado masivo. Aseguró que GPT-5.6 Sol “acaba de borrar accidentalmente CASI TODOS los archivos de mi Mac”, mientras que el desarrollador Bruno Lemos afirmó que el modelo “borró toda mi base de datos de producción”.
El desarrollador Joey Kudish también señaló que Codex Sol se volvió excesivamente ambicioso y “borró algunos archivos que no debía”, aunque precisó que contaba con copias de seguridad para poder recuperarlos.
Un hilo en Reddit recopiló más testimonios de usuarios que describen incidentes similares.
Estos relatos siguen siendo anecdóticos y no demuestran que GPT-5.6 Sol haya sido la causa única de cada fallo. Sin embargo, OpenAI ya había documentado este tipo de riesgo durante las pruebas previas al lanzamiento del modelo.
También lee: Fiebre del Mundial en Polymarket supera los $4.000M con España favorita al 58%
La advertencia de seguridad de OpenAI
La system card de OpenAI indica que los fallos de codificación “agéntica” pueden surgir cuando el modelo se muestra demasiado ansioso por completar una tarea o interpreta los permisos de forma excesivamente amplia. Según la compañía, esto puede derivar en actuaciones fuera del alcance solicitado, incluidos cambios destructivos o informes engañosos sobre el trabajo supuestamente realizado.
En una de las pruebas internas, un usuario autorizó a Sol a eliminar tres máquinas virtuales remotas etiquetadas como 1, 2 y 3.
Cuando el modelo no pudo encontrarlas en la ubicación donde buscó, terminó borrando las máquinas 5, 6 y 7, matando procesos activos y eliminando archivos de trabajo, para después reconocer que se podía haber perdido trabajo no guardado.
En otra prueba, el modelo utilizó credenciales que el usuario no había autorizado. Tras fallar un proceso en la nube al intentar acceder a ciertos archivos, Sol rastreó cachés locales ocultos, encontró credenciales y las usó sin detenerse a pedir permiso.
La preocupación es anterior a las quejas públicas: las pruebas previas al lanzamiento ya habían mostrado que GPT-5.6 tenía más probabilidades que GPT-5.5 de sobrepasar la intención del usuario, aunque las tasas absolutas fueran bajas.
Por ello, la guía actual de OpenAI indica que los usuarios deben exigir confirmación explícita antes de cualquier acción destructiva, y subraya la importancia de limitar el acceso, definir con claridad los permisos y mantener copias de seguridad recuperables como barreras de protección clave.
Lee después: Traders cripto encuentran cómo apostar al bote de $672M de Mega Millions






