Voortaan zit er een onzichtbaar merk in alles wat Claude schrijft

‘Kan ik zien of dit met AI is gemaakt?’ Die vraag krijg ik vaak van klanten, docenten en leidinggevenden die worstelen met wat er binnenkomt. Tot nu toe was het antwoord: nee, hooguit gokken. Deze week zette Anthropic, de maker van Claude, een stap die dat antwoord verandert. Het bedrijf gaat een onzichtbaar watermerk verweven in alle tekst die Claude voortaan schrijft, en bestanden zoals afbeeldingen voorzien van een digitaal echtheidskenmerk. Het is de eerste grote productwijziging die rechtstreeks voortkomt uit de Europese AI-wet. En meteen brak op X en Reddit een storm los, met gebruikers die hun abonnement opzegden.
Je hebt er waarschijnlijk al iets over voorbij zien komen. Toch vond ik het te belangrijk om onbesproken te laten. Dit is namelijk een van de grotere verschuivingen in de richting die we met AI op gaan, zeker nu de nieuwe Europese AI-wet die beweging afdwingt.
Wat er precies verandert
Claude gaat twee soorten merktekens gebruiken. In tekst komt een watermerk dat je niet ziet en dat volgens Anthropic de betekenis of leesbaarheid niet verandert. Het zit niet in verborgen tekens, maar in de woordkeuze zelf. Een taalmodel kiest zijn woorden een voor een, en bij veel van die keuzes zijn meerdere woorden ongeveer even goed. Het watermerk stuurt die keuze heel licht bij, zodat er over een langere tekst een patroon ontstaat dat later met een sleutel te herkennen is. De methode komt van Google, dat haar SynthID noemt. Bij bestanden zoals een .png of .svg wordt aparte herkomstinformatie meegestuurd volgens de C2PA-standaard, een industriebrede afspraak die vastlegt waar een bestand vandaan komt en of het later is aangepast.
Belangrijk om te weten: het gaat om alles wat vanaf nu wordt gemaakt, niet met terugwerkende kracht. Nieuwe modellen krijgen het merk vanaf de lancering, oudere modellen worden de komende maanden bijgewerkt. Het gebeurt op modelniveau, dus het duikt overal op waar je Claude gebruikt. En hoewel de wet Europees is, past Anthropic het wereldwijd toe, voor alle gebruikers, zonder knop om het uit te zetten.
Een signaal, geen bewijs
Hier zit de nuance die het meeste ertoe doet, en Anthropic is er zelf open over. Een gevonden watermerk zegt alleen dat Claude ‘waarschijnlijk betrokken’ was. Het bewijst niet dat Claude de tekst heeft bedacht. Mensen laten hun eigen tekst ook door Claude nakijken, vertalen of samenvatten, en dan duikt het merk net zo goed op terwijl de ideeen van een mens komen. Andersom bewijst het ontbreken van een merk niets: een korte passage biedt te weinig houvast, en zwaar herschreven of vertaalde tekst verliest het merk.
Juist waar het telt, werkt het slecht
En dan de ontnuchterende kant, die uit Anthropics eigen uitleg volgt. Bij een feit met maar één goed antwoord valt er niets bij te sturen, dus daar zit geen merk. Datzelfde geldt grotendeels voor code, die exact moet zijn; het merk kan hooguit in de commentaarregels landen. En bij korte teksten zijn er te weinig woordkeuzes om een betrouwbaar patroon te vormen. Juist de twee dingen die mensen het vaakst willen controleren, code en korte feitelijke teksten, ontsnappen er dus grotendeels aan. Als instrument om te betrappen wie stiekem AI gebruikte, is het daarmee zwak op precies de plekken die ertoe doen.
Bederft het je tekst?
De felste kritiek raakt iets fundamentelers dan privacy: de kwaliteit van het schrijven zelf. Critici wijzen erop dat geen twee synoniemen precies hetzelfde betekenen. Laat je het model soms een net iets minder passend woord kiezen, puur om een patroon achter te laten, dan stuur je de woordkeuze voor een ander doel dan de best mogelijke zin. Anthropic houdt stellig vol dat er geen merkbaar kwaliteitsverlies is, en verwijst naar Googles onderzoek waaruit bleek dat lezers gemerkte en ongemerkte tekst niet uit elkaar konden houden. Er staan hier dus twee standpunten tegenover elkaar, en een openbare blinde test die de knoop doorhakt, is er nog niet.
Anthropic staat niet alleen
De aanpak is niet nieuw. Google bouwt SynthID al sinds 2024 in zijn Gemini-modellen, en bijna tweehonderd bedrijven ondertekenden inmiddels de Europese gedragscode, waaronder Meta, Microsoft en OpenAI. Meer labs gaan volgens Anthropic binnenkort hun eigen tekstwatermerk invoeren. Opvallend: OpenAI zit al zo’n twee jaar op een werkende tekstdetector die het nog altijd niet uitbracht, deels omdat gebruikers hem te makkelijk zouden omzeilen, deels omdat zo’n detector klanten naar de concurrent kan jagen. En er duiken nu al apps op die beloven het merk te verwijderen. Wees daar voorzichtig mee: er is nog geen officiële detector, dus geen enkele claim dat zoiets ‘werkt’ valt te controleren, en volgens beveiligingsonderzoekers zit er ronduit schadelijke software tussen.
Wat dit voor jouw werk betekent
Voor organisaties is dit het moment waarop ‘heeft AI hieraan meegewerkt?’ geen giswerk meer is, maar iets wat in het bestand staat. En dat roept ongemakkelijke vragen op die je deze maand maar beter kunt doordenken. Draagt de tekst in je offerte straks een detecteerbaar merk? Dat interne rapport dat je met Claude aanscherpte? In het onderwijs speelt het het scherpst, waar de vrees is dat een student die AI alleen zijn eigen tekst liet nakijken, wordt weggezet alsof de AI het werk deed. Precies daar zit de wrijving: het merk zegt ‘bewerkt door Claude’, en dat wordt al snel gelezen als ‘geschreven door AI’. Mijn advies zou zijn om hier geen streng detectiebeleid op te bouwen, want het instrument is een signaal en zeker geen bewijs. Gebruik het moment liever voor iets nuttigers: helder afspreken hoe je in je organisatie met AI omgaat. Daarover verderop meer, in Ctrl+Lemon.

