OpenAI voegt een onzichtbaar ChatGPT-watermerk toe aan chatbot-teksten en Codex-code-uitvoer in de hele Europese Unie. Toch blijkt uit eigen tests van OpenAI dat als je een kwart van de woorden vervangt door synoniemen, de detectie daalt naar slechts 17%.
Deze stap is een reactie op de EU AI Act, het AI-wetboek van de Europese Unie. Deze wetgeving eist dat AI-gegenereerde tekst voorzien wordt van een machineleesbaar label. OpenAI geeft toe dat de technologie nog niet volwassen is. Daarom blijft de detector voorlopig niet beschikbaar voor het publiek.
Hoe sterk is het ChatGPT-watermerk als iemand het bewerkt
Volgens de aankondiging heet het systeem textGrain. Het stuurt de woordkeuze van het model zodat er een verborgen statistisch patroon ontstaat. Een aparte detector zoekt dit patroon in teksten op.
Het watermerk zit in de woordkeuze zelf, legt OpenAI uit in de FAQ. Er worden geen onzichtbare tekens, spaties of vreemde leestekens toegevoegd. Dat betekent dat het bekende trucje om verborgen tekens te verwijderen, hier niks uithaalt.
De lengte van de tekst is erg belangrijk. OpenAI telt tekst in tokens, stukjes van woorden waarmee AI-modellen werken. Eén token is ongeveer driekwart van een Engels woord.
Uit OpenAI’s eigen tests bleek dat de detector ongeveer 66% van de onbewerkte antwoorden met circa 150 woorden ontdekte. Bij ongeveer 300 woorden steeg dat percentage naar 92%.
Lichte bewerkingen maken het ChatGPT-watermerk ook zwakker. In teksten van 300 woorden, zorgde het vervangen van één op de tien woorden door een synoniem ervoor dat de detectie daalde van 92% naar 66%. Als één op de vier woorden werd vervangen, zakte de detectiekans naar slechts 17%.
Het watermerk beïnvloedde de benchmarkscores van OpenAI’s GPT-6 Astra, het nieuwste model van het bedrijf, nauwelijks.
Waarom mag het publiek de detector nog niet gebruiken
OpenAI biedt geen publieke tool aan, maar neemt aanvragen in behandeling van erkende onderzoekers en deskundige organisaties. Volgens het bedrijf laat een positief resultaat nooit een gebruiker, prompt of gesprek zien.
Een negatief resultaat geeft ook geen zekerheid. Korte, bewerkte of vertaalde teksten kunnen de detector ontwijken, net als resultaten van andere AI-tools.
De afwezigheid van een gevonden watermerk bewijst geen menselijk auteurschap.
Bron: OpenAI
Afbeeldingen en audio werken anders. Iedereen kan zulke bestanden uploaden naar OpenAI’s publieke verify-tool en ze laten controleren op het SynthID-watermerk.
Buiten Europa staat het ChatGPT-watermerk standaard uit. API-klanten wereldwijd kunnen nu wel kiezen om het voor bepaalde modellen in te schakelen via hun project- of organisatie-instellingen.
Deze invoering volgt op het begin van de AI Act-transparantiehandhaving in Europa sinds augustus. Voor crypto zijn de gevolgen duidelijk, want crimineel AI-gebruik steeg het afgelopen jaar met 40% volgens TRM Labs.
Daardoor zal de kloof tussen wat toezichthouders eisen en wat detectors daadwerkelijk kunnen aantonen, waarschijnlijk bepalen hoe grote AI-labs omgaan met regelgeving.









