OpenAI vai embutir uma marca d’água invisível em textos gerados pelo ChatGPT e pelo Codex na União Europeia, mas testes internos indicam que a simples troca de 10% das palavras já reduz a taxa de detecção para 66%.
Pontos-chave:
- A marcação será liberada nas próximas semanas para usuários elegíveis do ChatGPT e do Codex em todos os planos na UE, e seguirá opcional para clientes de API.
- Substituir 25% das palavras por sinônimos derrubou a detecção para 17% na própria avaliação da empresa.
- O acesso ao detector ficará restrito, no início, a pesquisadores aprovados e instituições especializadas.
Implantação da marca d’água da OpenAI
A empresa anunciou o plano na segunda‑feira em um post no blog, informando que a marca d’água chegará, nas próximas semanas, aos usuários elegíveis do ChatGPT e do Codex em todos os planos na União Europeia. A funcionalidade não será adotada como padrão global no lançamento.
Desenvolvedores que usam a API da companhia em qualquer lugar do mundo já podem ativar o recurso em alguns modelos, mas ele permanece desligado por padrão. A iniciativa responde às exigências da Lei de IA da UE, cujas obrigações de marcação entraram em vigor em 2 de agosto e determinam que provedores tornem textos gerados por IA identificáveis por máquinas. Empresas que já operam no mercado têm até 2 de dezembro para se adequar.
Veja também: Agente de IA da Binance monta estratégias a partir de frases simples e cobra 19,99 USDC por operação
Limites de detecção do TextGrain
A técnica, batizada de textGrain, não adiciona qualquer símbolo visível, mas altera sutilmente as escolhas de palavras do modelo, criando um padrão estatístico que pode ser captado por um detector e que permanece mesmo em textos copiados. A OpenAI afirma que o método igualou ou superou outras abordagens avaliadas, incluindo o SynthID para texto, do Google, e diz planejar liberar a tecnologia como código aberto.
Edições humanas enfraquecem esse sinal.
Em testes com trechos de 400 tokens, trocar 10% das palavras por sinônimos reduziu a taxa de detecção de cerca de 92% para 66%. A substituição de 25% das palavras derrubou a identificação para 17%. Textos mais curtos, respostas de matemática e traduções também são mais difíceis de sinalizar: o detector acerta em torno de 80% dos trechos de 200 tokens em temas como psicologia, mantendo taxa de falso positivo em 1%.
Acesso ao detector do ChatGPT
Por ora, a OpenAI restringe o uso do detector a pesquisadores aprovados e organizações especializadas, alegando o risco de falhas na leitura da marca d’água e de falsos positivos. A empresa também ressalta que a ausência de marcação “não prova autoria humana” e que a marca d’água não identifica o usuário, a conta ou o prompt que originou o texto.
O movimento segue os passos da Anthropic, que anunciou em agosto que passaria a marcar com água, globalmente, textos gerados pelo Claude — medida que gerou críticas de parte da base de usuários. A OpenAI já havia desenvolvido um esquema de marca d’água para texto antes, mas o manteve em suspenso, em parte por receio de que usuários migrassem para rivais, segundo reportagem de 2024. As duas empresas, ao lado de Google, Meta e Microsoft, assumiram compromisso com o código de boas práticas da UE para transparência em conteúdos gerados por IA.
Leia a seguir: Giorgia Meloni quer registrar sua voz como marca. Isso vai barrar os deepfakes de IA?

