AI & computing › Generatieve AI & synthetische media

Anthropic opent AI-watermerkdetectie voor toezichthouders en journalisten

· Bijgewerkt 1 september 2026, 23:10 · 2 min leestijd

Generatieve AI & synthetische media
Beeld: The Decoder

Anthropic laat vanaf nu toezichthouders, journalisten en factcheckers controleren of een tekst is geschreven door zijn AI-model Claude. Het bedrijf lanceert daarvoor een speciale detectietool, die gebruikmaakt van een onzichtbaar watermerk in de tekst. De stap hangt samen met nieuwe Europese regels die AI-bedrijven verplichten hun teksten herkenbaar te maken.

Sinds augustus 2025 moeten nieuwe taalmodellen van Anthropic onder de Europese AI-wetgeving een onzichtbaar watermerk verwerken in gegenereerde tekst. Dat watermerk moet achteraf aantonen dat een stuk tekst door AI is geschreven. Tot nu toe kon vrijwel niemand buiten Anthropic dat watermerk daadwerkelijk uitlezen. Daar komt verandering in: het bedrijf opent een detectie-API waarmee externe partijen kunnen checken of een tekst het watermerk van Claude bevat.

Wie mag de tool gebruiken?

Toegang tot de nieuwe watermerkdetectie-API is voorlopig beperkt tot een geselecteerde groep. Anthropic noemt regelgevers, opsporingsdiensten, media, factcheckers, onafhankelijke onderzoekers, onderwijsinstellingen en maatschappelijke organisaties binnen de Europese Unie. Ook bedrijven die moeten aantonen dat ze aan de watermerkplicht voldoen, kunnen een aanvraag indienen. Anthropic zegt de kring van gebruikers in de loop van de tijd te willen uitbreiden. Voor gewone consumenten is de tool vooralsnog niet beschikbaar.

Hoe werkt het watermerk?

De techniek bouwt voort op SynthID, een methode die Google eerder ontwikkelde voor het markeren van AI-gegenereerde tekst. Het systeem past de willekeur aan waarmee een taalmodel woorden kiest, zodat er een statistisch patroon ontstaat dat vrijwel onzichtbaar is voor lezers maar wel meetbaar is met de juiste software. Volgens Anthropic overleeft dat patroon zelfs een deel van latere bewerkingen aan de tekst, waardoor de methode betrouwbaarder zou zijn dan bestaande AI-tekstdetectoren zoals Pangram, die vooral schrijfstijl analyseren. Het bedrijf benadrukt dat het watermerk geen gebruikersgegevens bevat en dat het de kwaliteit of inhoud van de tekst niet beïnvloedt.

Kritiek op de aanpak

Niet iedereen is overtuigd. Critici stellen dat de kwaliteit van teksten wél kan lijden onder de techniek, omdat het model soms synoniemen kiest op basis van een verborgen sleutel in plaats van op basis van de beste betekenis. Vakblad Artificial Lawyer wijst bovendien op een ander risico: detecteerbare AI-sporen kunnen problemen opleveren in situaties waarin contracten het gebruik van AI verbieden, of bij onderhandelingen over honoraria waarbij blijkt dat een tekst deels door een taalmodel is opgesteld. Het blad verwacht overigens dat de gevolgen van het watermerk in de praktijk vooral beperkt zullen blijven. De lancering van de detectietool markeert wel een nieuwe fase in hoe AI-bedrijven omgaan met transparantie: niet langer alleen beloftes over herkenbaarheid, maar ook daadwerkelijke controlemiddelen voor buitenstaanders.

Achtergrond & begrippen

Wat betekent dit voor de toekomst? Nu AI-teksten steeds moeilijker te onderscheiden zijn van menselijk werk, wordt onafhankelijke verificatie belangrijker voor journalistiek, onderwijs en rechtshandhaving. Anthropic laat zien dat watermerktechnologie niet alleen een wettelijke verplichting kan zijn, maar ook een bruikbaar instrument tegen desinformatie — mits de toegang breed en eerlijk genoeg wordt georganiseerd.

Watermerk
Een onzichtbaar patroon dat in AI-gegenereerde tekst wordt verwerkt om achteraf te kunnen aantonen dat de tekst door een AI-model is geschreven.
Watermerkdetectie-API
Een technische koppeling waarmee goedgekeurde organisaties kunnen controleren of een tekst het watermerk van Claude bevat.
AI-tekstdetector
Software die probeert te herkennen of een tekst door een mens of door kunstmatige intelligentie is geschreven, vaak op basis van schrijfstijl.
SynthID
Een door Google ontwikkelde methode om AI-gegenereerde tekst te voorzien van een statistisch detecteerbaar patroon, waarop Anthropics systeem is gebaseerd.
EU AI Act
De Europese wetgeving die onder meer regels stelt aan de herkenbaarheid van AI-gegenereerde content.
Taalmodel
Een AI-systeem dat, getraind op grote hoeveelheden tekst, mensachtige tekst kan genereren en begrijpen.

Bronnen

Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.

Meer over Generatieve AI & synthetische media