OpenAI incorporará una marca de agua invisible en los textos generados por ChatGPT y Codex en la Unión Europea, aunque sus propias pruebas muestran que sustituir un 10% de las palabras reduce la tasa de detección al 66%.
Claves:
- La marca de agua se activará para usuarios elegibles de ChatGPT y Codex en todos los planes de la UE en las próximas semanas y seguirá siendo opcional para clientes de la API.
- Sustituir el 25% de las palabras por sinónimos redujo la detección al 17% en las pruebas internas de la compañía.
- El acceso al detector estará restringido inicialmente a investigadores y organizaciones especializadas aprobadas.
Despliegue de la marca de agua de OpenAI
La compañía anunció el plan el lunes en una entrada de blog, en la que explicó que el marcado llegará a usuarios elegibles de ChatGPT y Codex en todos los planes dentro de la UE en las próximas semanas. No se activará como ajuste global por defecto en el lanzamiento.
Los desarrolladores que usan la API de la empresa en cualquier parte del mundo ya pueden activar la función en determinados modelos, aunque permanece desactivada por defecto. El movimiento responde a la Ley de IA de la UE, cuyas obligaciones de marcado entraron en vigor el 2 de agosto y exigen que los proveedores hagan que el texto generado por IA sea identificable por sistemas automatizados. Las compañías que ya operan en el mercado tienen de plazo hasta el 2 de diciembre para cumplir.
También ver: El agente de IA de Binance crea estrategias desde frases simples y cobra 19,99 USDC por operar
Límites de detección de TextGrain
El método, denominado textGrain, no añade ningún símbolo visible, sino que ajusta sutilmente las elecciones de palabras del modelo, dejando un patrón estadístico que un detector puede identificar y que se mantiene incluso cuando el texto se copia. OpenAI afirma que iguala o supera a otros enfoques que ha probado, incluida la tecnología SynthID para texto de Google, y que planea liberar la tecnología como código abierto.
Las ediciones debilitan esa señal.
En una evaluación de pasajes de 400 tokens, sustituir un 10% de las palabras por sinónimos redujo la detección de alrededor del 92% al 66%. Elevar el reemplazo al 25% de las palabras la bajó al 17%. Los textos más breves, las respuestas matemáticas y las traducciones también son más difíciles de señalar, con el detector identificando aproximadamente el 80% de los pasajes de 200 tokens sobre temas como psicología, manteniendo una tasa de falsos positivos del 1%.
Acceso al detector de ChatGPT
OpenAI limitará por ahora el acceso a su detector a investigadores y organizaciones expertas aprobadas, alegando el riesgo tanto de marcas de agua no detectadas como de falsos positivos. También advierte de que la ausencia de marca de agua «no demuestra autoría humana» y aclara que el marcado no identifica al usuario, la cuenta ni el prompt que originó el texto.
El paso sigue los movimientos de Anthropic, que en agosto anunció que marcaría con agua el texto generado por Claude en todo el mundo, una decisión que provocó quejas de parte de sus usuarios. OpenAI ya había desarrollado anteriormente una marca de agua para texto, pero la mantuvo en reserva, en parte por el temor a que los usuarios migraran a la competencia, según una información periodística de 2024. Ambas compañías, junto con Google, Meta y Microsoft, se han adherido al código de buenas prácticas de la UE sobre transparencia en contenidos generados por IA.
Lea a continuación: Giorgia Meloni quiere registrar su voz como marca, ¿bastará para frenar los deepfakes de IA?

