Le filigrane invisible de ChatGPT arrive dans l’UE, mais de légères retouches font chuter la détection à 66 %

Text from OpenAI's ChatGPT and Codex will carry an invisible EU watermark that weakens when 10% of words are swapped (Image: Shutterstock)
Text from OpenAI's ChatGPT and Codex will carry an invisible EU watermark that weakens when 10% of words are swapped (Image: Shutterstock)

OpenAI va intégrer un filigrane invisible dans les textes générés par ChatGPT et Codex dans l’Union européenne, même si ses propres tests montrent qu’un simple remplacement de 10 % des mots fait chuter le taux de détection à 66 %.

À retenir :

  • Le filigrane sera progressivement activé pour les utilisateurs éligibles de ChatGPT et Codex, tous abonnements confondus, dans l’UE, et restera en mode opt-in pour les clients API.
  • Remplacer 25 % des mots par des synonymes a réduit le taux de détection à 17 % lors des tests internes.
  • L’accès au détecteur est réservé, au lancement, aux chercheurs agréés et aux organisations spécialisées.

Déploiement du filigrane d’OpenAI

L’entreprise a annoncé lundi dans un billet de blog que ce marquage serait étendu, dans les prochaines semaines, aux utilisateurs éligibles de ChatGPT et Codex dans l’UE, quel que soit leur type d’abonnement. Le système ne deviendra pas la configuration par défaut à l’échelle mondiale au lancement.

Les développeurs qui utilisent l’API de la société partout dans le monde peuvent dès à présent activer le filigrane sur certains modèles, même s’il reste désactivé par défaut. Cette évolution répond aux exigences de l’AI Act européen, dont les obligations de marquage sont entrées en vigueur le 2 août et imposent aux fournisseurs de rendre les textes générés par l’IA identifiables par des systèmes automatisés. Les acteurs déjà présents sur le marché disposent d’un délai jusqu’au 2 décembre pour se mettre en conformité.

À lire aussi : L’agent IA de Binance élabore des stratégies à partir de simples phrases et facture 19,99 USDC par trade

Les limites de détection de textGrain

La méthode, baptisée textGrain, n’ajoute aucun signe visible mais infléchit subtilement les choix de mots du modèle, de façon à laisser une empreinte statistique que le détecteur peut repérer et qui persiste même si le texte est copié. OpenAI affirme que ce procédé égale ou dépasse les autres solutions testées, dont SynthID pour le texte de Google, et prévoit de publier la technologie en open source.

Les retouches éditoriales affaiblissent toutefois ce signal.

Dans une évaluation portant sur des passages de 400 tokens, le remplacement de 10 % des mots par des synonymes a fait passer le taux de détection d’environ 92 % à 66 %. En remplaçant 25 % des mots, la détection tombe à 17 %. Les textes courts, les réponses mathématiques et les traductions sont eux aussi plus difficiles à repérer : pour des passages de 200 tokens sur des sujets comme la psychologie, le détecteur n’identifie qu’environ 80 % des cas, pour un taux de faux positifs limité à 1 %.

Accès restreint au détecteur ChatGPT

Pour l’instant, OpenAI réserve son détecteur aux chercheurs accrédités et aux organisations expertes, invoquant le risque à la fois de filigranes manqués et de faux positifs. Le groupe souligne également qu’en l’absence de filigrane, « cela ne prouve pas une rédaction humaine », et précise que la marque ne permet pas d’identifier l’utilisateur, le compte ou la requête à l’origine du passage analysé.

Cette démarche intervient après Anthropic, qui a annoncé en août qu’elle apposerait un filigrane sur tous les textes générés par Claude à l’échelle mondiale, une décision qui a suscité des critiques chez certains utilisateurs. OpenAI avait déjà conçu un filigrane textuel par le passé, mais l’avait gardé en réserve, notamment par crainte de voir ses utilisateurs migrer vers la concurrence, selon un article de presse de 2024. Les deux sociétés, ainsi que Google, Meta et Microsoft, se sont engagées à respecter le code de bonnes pratiques européen sur la transparence des contenus générés par l’IA.

À suivre : Giorgia Meloni veut déposer sa voix comme marque, un rempart contre les deepfakes IA ?

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev est responsable du contenu chez Yellow.com. Il se spécialise dans des articles de recherche et d’apprentissage approfondis, avec un accent sur les analyses, le contexte sectoriel et les grandes forces qui façonnent la crypto, de l’ère de l’IA et des technologies de sécurité à l’innovation fintech. Il est convaincu que tout ce qui est numérique dépassera très bientôt tout ce qui est analogique et travaille dur pour que cela devienne réalité.

Avertissement et avertissement sur les risques : Les informations fournies dans cet article sont à des fins éducatives et informatives uniquement et sont basées sur l'opinion de l'auteur. Elles ne constituent pas des conseils financiers, d'investissement, juridiques ou fiscaux. Les actifs de cryptomonnaie sont très volatils et sujets à des risques élevés, y compris le risque de perdre tout ou une partie substantielle de votre investissement. Le trading ou la détention d'actifs crypto peut ne pas convenir à tous les investisseurs. Les opinions exprimées dans cet article sont uniquement celles de l'auteur/des auteurs et ne représentent pas la politique officielle ou la position de Yellow, de ses fondateurs ou de ses dirigeants. Effectuez toujours vos propres recherches approfondies (D.Y.O.R.) et consultez un professionnel financier agréé avant de prendre toute décision d'investissement.
Dernières nouvelles
Voir toutes les nouvelles
Le filigrane invisible de ChatGPT arrive dans l’UE, mais de légères retouches font chuter la détection à 66 % | Yellow