OpenAI va intégrer un filigrane invisible dans les textes générés par ChatGPT et Codex dans l’Union européenne, même si ses propres tests montrent qu’un simple remplacement de 10 % des mots fait chuter le taux de détection à 66 %.
À retenir :
- Le filigrane sera progressivement activé pour les utilisateurs éligibles de ChatGPT et Codex, tous abonnements confondus, dans l’UE, et restera en mode opt-in pour les clients API.
- Remplacer 25 % des mots par des synonymes a réduit le taux de détection à 17 % lors des tests internes.
- L’accès au détecteur est réservé, au lancement, aux chercheurs agréés et aux organisations spécialisées.
Déploiement du filigrane d’OpenAI
L’entreprise a annoncé lundi dans un billet de blog que ce marquage serait étendu, dans les prochaines semaines, aux utilisateurs éligibles de ChatGPT et Codex dans l’UE, quel que soit leur type d’abonnement. Le système ne deviendra pas la configuration par défaut à l’échelle mondiale au lancement.
Les développeurs qui utilisent l’API de la société partout dans le monde peuvent dès à présent activer le filigrane sur certains modèles, même s’il reste désactivé par défaut. Cette évolution répond aux exigences de l’AI Act européen, dont les obligations de marquage sont entrées en vigueur le 2 août et imposent aux fournisseurs de rendre les textes générés par l’IA identifiables par des systèmes automatisés. Les acteurs déjà présents sur le marché disposent d’un délai jusqu’au 2 décembre pour se mettre en conformité.
À lire aussi : L’agent IA de Binance élabore des stratégies à partir de simples phrases et facture 19,99 USDC par trade
Les limites de détection de textGrain
La méthode, baptisée textGrain, n’ajoute aucun signe visible mais infléchit subtilement les choix de mots du modèle, de façon à laisser une empreinte statistique que le détecteur peut repérer et qui persiste même si le texte est copié. OpenAI affirme que ce procédé égale ou dépasse les autres solutions testées, dont SynthID pour le texte de Google, et prévoit de publier la technologie en open source.
Les retouches éditoriales affaiblissent toutefois ce signal.
Dans une évaluation portant sur des passages de 400 tokens, le remplacement de 10 % des mots par des synonymes a fait passer le taux de détection d’environ 92 % à 66 %. En remplaçant 25 % des mots, la détection tombe à 17 %. Les textes courts, les réponses mathématiques et les traductions sont eux aussi plus difficiles à repérer : pour des passages de 200 tokens sur des sujets comme la psychologie, le détecteur n’identifie qu’environ 80 % des cas, pour un taux de faux positifs limité à 1 %.
Accès restreint au détecteur ChatGPT
Pour l’instant, OpenAI réserve son détecteur aux chercheurs accrédités et aux organisations expertes, invoquant le risque à la fois de filigranes manqués et de faux positifs. Le groupe souligne également qu’en l’absence de filigrane, « cela ne prouve pas une rédaction humaine », et précise que la marque ne permet pas d’identifier l’utilisateur, le compte ou la requête à l’origine du passage analysé.
Cette démarche intervient après Anthropic, qui a annoncé en août qu’elle apposerait un filigrane sur tous les textes générés par Claude à l’échelle mondiale, une décision qui a suscité des critiques chez certains utilisateurs. OpenAI avait déjà conçu un filigrane textuel par le passé, mais l’avait gardé en réserve, notamment par crainte de voir ses utilisateurs migrer vers la concurrence, selon un article de presse de 2024. Les deux sociétés, ainsi que Google, Meta et Microsoft, se sont engagées à respecter le code de bonnes pratiques européen sur la transparence des contenus générés par l’IA.
À suivre : Giorgia Meloni veut déposer sa voix comme marque, un rempart contre les deepfakes IA ?

