Watermerken in AI, een stap vooruit in controleerbaarheid.

Niek Baarsma

Watermerken in AI, een stap vooruit in controleerbaarheid.

Elk Claude-model dat vanaf 2 augustus 2026 uitkomt, markeert zijn eigen tekst. Je ziet er niets van, en dat is precies de bedoeling. Het watermerk zit verweven in de tekst zelf en is alleen te herkennen door wie de sleutel heeft. Voor de modellen van vóór die datum volgt de markering de komende maanden.

De aanleiding is de Europese AI-verordening. Dit artikel gaat over Claude, omdat Anthropic als eerste uitlegde hoe het werkt. De verplichting geldt voor de hele markt.

Wat er verandert

De nieuwe modellen weven een onzichtbaar watermerk in de tekst die ze genereren. Voor bestanden werkt het anders. Bij een .png, .jpg of .svg voegt Claude een ondertekend herkomstlabel toe aan de metadata, volgens de open C2PA-standaard die ook camerafabrikanten en fotobewerkingssoftware gebruiken.

De markering zit op modelniveau. Ze komt dus mee in alle producten: Claude zelf, de API, Claude Code, Cowork en Tag. Voor oudere modellen geldt een overgangsperiode uit de Europese regels. Uitzetten kan niet.

Het watermerk reist mee met de tekst. Kopieer je een antwoord naar Word of naar een e-mail, dan gaat het mee. Lichte bewerking overleeft het meestal.

Waarom dit gebeurt

Anthropic ondertekende in juli 2026, samen met ongeveer 190 andere partijen, de Europese Code of Practice over transparantie van AI-content. Die vraagt aanbieders om AI-gegenereerde tekst machineleesbaar te markeren.

Dit is dus geen keuze van één leverancier. De andere grote modelmakers tekenden dezelfde afspraak en bouwen hun eigen markering. Anthropic past het wereldwijd toe, omdat er nog geen betrouwbare manier is om het per regio te beperken.

Hoe het werkt

Een taalmodel kiest woord voor woord. Bij "het weer was koud en" ligt zowel "grijs" als "bewolkt" voor de hand. Welke van de twee het wordt, maakt voor de betekenis niet uit. Normaal bepaalt toeval die keuze.

Het watermerk vervangt dat toeval door een patroon dat is afgeleid van een sleutel. De woorden blijven even logisch, de tekst leest hetzelfde. Maar wie de sleutel heeft, kan achteraf berekenen hoe waarschijnlijk het is dat Claude meeschreef.

Er worden geen tekens toegevoegd, geen verborgen symbolen, geen extra tokens. Het kost je niets extra en het model wordt er niet trager van. Anthropic gebruikt een variant van SynthID-Text, de methode die Google DeepMind in 2024 publiceerde in Nature. In tests zagen zowel Google als Anthropic geen verschil in kwaliteit, creativiteit of leesbaarheid.

Een detectie-API is aangekondigd. Wanneer die er precies is, is nog niet bekend.

Wat het watermerk niet bewijst

Hier zijn de beperkingen belangrijker dan de belofte, want ze zijn fors.

  • Het zegt iets over waarschijnlijkheid, niet over auteurschap. Een watermerk laat zien dat Claude waarschijnlijk betrokken was. Het maakt geen onderscheid tussen "Claude schreef dit" en "Claude heeft dit stevig geredigeerd".
  • Korte teksten leveren te weinig signaal op. Hoe langer het stuk, hoe betrouwbaarder de uitkomst.
  • Feiten en code dragen nauwelijks watermerk. Waar maar één antwoord goed is, valt er niets te kiezen.
  • Liet je Claude alleen je spelling nakijken, dan blijft het meeste van jou. Er is dan te weinig om te markeren.
  • Andere AI wordt niet herkend. Een ander model heeft een andere sleutel, of helemaal geen watermerk.
  • Een volledige herschrijving haalt het watermerk eruit. Dan is de vraag of je nog van AI-tekst kunt spreken.

Wat het ook niet doet: iets over jou vastleggen. Het watermerk bevat geen informatie over de gebruiker, de organisatie of het gesprek. Het gaat over Claude, niet over jou. Aan eigendom en aansprakelijkheid van de output verandert het niets.

Wat dit betekent voor jouw organisatie

Onderwijs is het voorbeeld dat overal opduikt: scripties, essays, tentamens. Maar dezelfde vraag komt bij jou langs, alleen dan over een offerte, een rapport of een advies aan een klant. "Is dit door AI gemaakt?" wordt vanaf nu een vraag met een antwoord.

Ons advies is nuchter. Leg vast waar AI wel en niet mag, en wie de tekst controleert voordat hij de deur uit gaat. Dat kost je een middag, en het scheelt je een ongemakkelijk gesprek achteraf.

Wat wij niet zouden doen: AI-gebruik behandelen als iets om iemand op te betrappen. Het watermerk vertelt dat een model betrokken was. Het vertelt niet of er iemand heeft nagedacht. Dat is de vraag die telt, in een collegezaal net zo goed als in jouw bedrijf.

Een tekst die door AI is geschreven en door een mens is getoetst, is meestal beter dan een tekst die een gehaaste collega er in tien minuten uit perst. Een AI-tekst die niemand heeft gelezen voordat hij naar de klant ging, is een risico. Dat was hij ook al zonder watermerk.

De techniek maakt transparantie meetbaar. Het oordeel blijft mensenwerk, en dat is precies waar jij aan zet bent.

De volgende stap

Wil je weten wat dit betekent voor jouw AI-beleid? Plan een gesprek van 30 minuten. We bespreken wat je moet vastleggen, wat je kunt laten liggen, en waar AI bij jou geen antwoord op is.

Bron: Anthropic, "How Claude's text watermark works" (14 augustus 2026) en het Anthropic Help Center.

Op zoek naar verdieping?

Neem contact met ons op voor trainingen met betrekking tot Prompt Engineering, AI-automation en nog veel meer.