Naar hoofdinhoud
Home/Nieuws/Anthropic legt uit hoe de watermark in Claude-tekst werkt
SEO

Anthropic legt uit hoe de watermark in Claude-tekst werkt

A
Angelo van Cleef
·15 augustus 2026·3 min leestijd
Anthropic legt uit hoe de watermark in Claude-tekst werkt
Direct antwoord
Anthropic heeft toegelicht dat Claude AI-gegenereerde tekst voorziet van een statistisch patroon in woordkeuze, waarmee output achteraf herkenbaar is. Het bedrijf erkent echter dat parafraseren, vertalen of herschrijven van de tekst dit patroon grotendeels vernietigt, waardoor de watermark geen waterdicht bewijs van AI-gebruik oplevert.

Anthropic heeft voor het eerst gedetailleerd uitgelegd hoe de watermark werkt die het bedrijf verwerkt in tekst die door Claude wordt gegenereerd, en erkent daarbij direct de zwakke plek: de techniek is relatief eenvoudig te omzeilen. Voor wie AI-gegenereerde content wil opsporen, is dat een belangrijk signaal. Een watermark is een aanwijzing, geen bewijs.

Het bedrijf publiceerde de toelichting nadat er langer onduidelijkheid bestond over hoe groot techbedrijven AI-tekst technisch herkenbaar maken. Met deze uitleg schuift Anthropic mee in een discussie die al langer speelt bij onder meer Google DeepMind, dat met SynthID een vergelijkbare aanpak hanteert voor tekst en beeld.

Hoe de watermark van Claude werkt

De methode berust op een statistisch trucje in de manier waarop een taalmodel woorden kiest. Bij elk volgend woord in een zin heeft het model meerdere geschikte opties, en normaal gesproken kiest het daaruit op basis van waarschijnlijkheid.

Door die kansverdeling subtiel te sturen, ontstaat een patroon dat voor een lezer onzichtbaar blijft maar statistisch meetbaar is. Onderzoek van de Universiteit van Maryland uit 2023, van onder meer John Kirchenbauer en collega's, liet al zien dat dit soort technieken op ongewijzigde tekst detectiepercentages boven de 99 procent kunnen halen.

Waarom de watermark te omzeilen is

Het probleem zit in de kwetsbaarheid van het statistische patroon zelf. Zodra een tekst wordt herschreven, vertaald of samengevat, verandert de onderliggende woordverdeling zo sterk dat het watermerk grotendeels verdwijnt.

Anthropic erkent dat expliciet: eenvoudige bewerkingen zijn al voldoende om detectie onbetrouwbaar te maken. Dat betekent in de praktijk dat iemand die AI-tekst plakt in een ander model om te laten parafraseren, de sporen daarmee grotendeels wist.

  • Herschrijven of parafraseren door een tweede AI-model
  • Vertalen naar een andere taal en terugvertalen
  • Handmatig herstructureren van zinnen en alinea's
  • Combineren van AI-tekst met substantieel eigen materiaal

Gevolgen voor contentdetectie en SEO

Voor uitgevers, marketeers en zoekmachines verandert dit weinig aan de bestaande praktijk, maar het bevestigt wel wat veel professionals al vermoedden. Watermark-detectie is nuttig als extra signaal in een breder proces, niet als eindoordeel.

Zoekmachines zoals Google hebben al eerder aangegeven dat ze niet primair op herkomst van tekst sturen, maar op kwaliteit en nuttigheid voor de lezer. Deze onthulling van Anthropic onderstreept dat detectie op basis van watermarks daarin hooguit een aanvullende rol kan spelen.

Voor bedrijven die overwegen AI-detectietools in te zetten voor contentbeleid, is de les simpel: bouw niet uitsluitend op een technologie die met een korte bewerkingsstap te omzeilen is.

Bron: Search Engine Journal

Gerelateerde artikelen

A
Geschreven door
Professioneel full-stack developer & oprichter van CreativeDeals

Angelo van Cleef is full-stack developer met 25+ jaar ervaring in o.a. PHP, JavaScript, TypeScript en Golang. Hij combineert softwareontwikkeling met SEO, SEA en platformgroei. Op het CreativeDeals-blog deelt hij praktische kennis voor ondernemers en developers.

Online:
Akira