OpenAI gaat een onzichtbaar watermerk inbouwen in door ChatGPT en Codex gegenereerde tekst in de Europese Unie. Eigen testen laten zien dat het vervangen van slechts 10% van de woorden de kans op detectie al terugbrengt tot 66%.
Kernpunten:
- Het watermerk wordt de komende weken uitgerold naar in aanmerking komende ChatGPT‑ en Codex‑gebruikers in de EU, in alle abonnementsvormen; voor API‑klanten blijft het opt‑in.
- Het vervangen van 25% van de woorden door synoniemen drukte de detectiegraad in OpenAI’s eigen metingen naar 17%.
- Toegang tot de detector is bij de start beperkt tot goedgekeurde onderzoekers en gespecialiseerde instellingen.
Uitrol van OpenAI‑watermerk
Het bedrijf maakte maandag bekend in een blogpost dat de markering de komende weken beschikbaar komt voor in aanmerking komende ChatGPT‑ en Codex‑gebruikers in de EU, in alle betaalde en gratis plannen. De functie wordt bij de lancering geen wereldwijde standaardinstelling.
Ontwikkelaars die de API van het bedrijf gebruiken, waar ook ter wereld, kunnen de functie nu al inschakelen voor geselecteerde modellen, al blijft ze standaard uit. De stap is een reactie op de EU AI Act, waarvan de verplichtingen rond markering op 2 augustus van kracht zijn geworden en aanbieders verplichten om AI‑gegenereerde tekst machine‑leesbaar herkenbaar te maken. Bedrijven die al actief zijn op de markt hebben tot 2 december om te voldoen.
Ook interessant: Binance AI‑agent bouwt strategieën uit gewone zinnen en rekent 19,99 USDC per trade
Beperkingen van TextGrain‑detectie
De methode, textGrain genoemd, voegt geen zichtbaar symbool toe, maar stuurt subtiel de woordkeuze van het model. Daardoor ontstaat een statistisch patroon dat een detector kan herkennen en dat behouden blijft als tekst wordt gekopieerd. Volgens OpenAI presteert textGrain even goed of beter dan andere geteste methoden, waaronder Google’s SynthID voor tekst. Het bedrijf zegt de technologie als open source te willen vrijgeven.
Bewerking van de tekst verzwakt het signaal echter aanzienlijk.
In een test met tekstpassages van 400 tokens verlaagde het vervangen van 10% van de woorden door synoniemen de detectie van circa 92% naar 66%. Het vervangen van 25% van de woorden drukte de detectiekans verder terug naar 17%. Korte passages, wiskunde‑antwoorden en vertaalde tekst zijn eveneens lastiger te herkennen: bij passages van 200 tokens over onderwerpen als psychologie vangt de detector zo’n 80% bij een vals‑positiefpercentage van 1%.
Toegang tot ChatGPT‑detector
Voorlopig beperkt OpenAI de toegang tot zijn detector tot goedgekeurde onderzoekers en gespecialiseerde organisaties, onder verwijzing naar het risico op gemiste watermerken en foutieve toeschrijvingen. Het bedrijf benadrukt bovendien dat de afwezigheid van een watermerk „geen bewijs is van menselijk auteurschap” en dat het watermerk geen informatie bevat over de gebruiker, de account of de prompt achter een tekstfragment.
De stap volgt op die van Anthropic, dat in augustus aankondigde wereldwijd watermerken toe te voegen aan door Claude gegenereerde tekst — een besluit dat kritiek opleverde van sommige gebruikers. OpenAI had eerder al een tekstwatermerk ontwikkeld, maar hield dat tegen, onder meer uit vrees dat gebruikers zouden overstappen naar concurrenten, aldus een nieuwsbericht uit 2024. Beide bedrijven, samen met Google, Meta en Microsoft, hebben zich gecommitteerd aan de Europese gedragscode rond transparantie voor AI‑gegenereerde content.
Lees ook: Giorgia Meloni wil een merk op haar stem, houdt dat AI‑deepfakes tegen?

