Default
Door staff@engadget.com (Mariella Moon) - 15 Aug 2026
Anthropic heeft onthuld hoe het de door Claude AI gegenereerde tekst van een watermerk voorziet om te voldoen aan de nieuwe AI-transparantieregels van de Europese Unie. Het bedrijf zei dat de tekstwatermerken geen gemakkelijk zichtbare beelden zullen hebben, niet te onderscheiden zullen zijn voor de mensen die het lezen en geen verborgen tekens aan de tekst zullen toevoegen. In plaats daarvan houdt de methode van Anthropic in dat er een patroon in de tekst wordt achtergelaten dat alleen kan worden gedecodeerd door iemand die er de sleutel voor heeft.
Het bedrijf legde uit dat grote taalmodellen bij het genereren van tekst één woord tegelijk kiezen door te kiezen uit een lijst met mogelijk geschikte woorden om te gebruiken. Ze kiezen woorden willekeurig, zolang ze maar zinvol zijn voor de context van wat ze genereren. Als het watermerk is ingeschakeld, gebruikt Claude een sleutel om te beslissen welk woord hij moet kiezen, in plaats van een willekeurige generator voor willekeurige getallen te gebruiken om het volgende woord te kiezen.
In zijn voorbeeld gebruikte Anthropic de cijfers van pi als sleutel. Stel dat de sleutel begint met het cijfer 2 uit de pi-reeks 3.1415926535. Het volgende gegenereerde woord is het zesde in de keuzelijst, dan het vijfde, het derde en dan weer het vijfde. Deze methode is een aanpassing van de SynthID-Text-benadering van watermerken van Google DeepMind, die het team beschreef in een artikel gepubliceerd in Nature. Watermerken hebben geen invloed op de kwaliteit van Claude's productie en vertragen deze ook niet, aldus het bedrijf. Bovendien zijn er geen extra tokens nodig en worden generaties niet duurder.
Natuurlijk heeft AI-gegenereerd proza doorgaans aanwijzingen. Modellen gebruiken graag bepaalde zinsconstructies, zoals 'dit is niet [X], maar [Y]'. Maar deze aanwijzingen zijn alleen voldoende om u te laten weten dat er een AI betrokken was bij het schrijven van die tekst, en niet het gebruikte model. Anthropic zal een API vrijgeven die "sleutels" heeft om Claude's watermerken te decoderen en zal kunnen zeggen of de AI het tekstblok heeft gegenereerd dat wordt gecontroleerd.
Anthropic geeft toe dat de methode voor het watermerken van tekst beperkingen kent. Het kan niet zeggen of Claude de tekst daadwerkelijk heeft geschreven of deze alleen heeft bewerkt, wat betekent dat als je de AI vraagt om iets voor je te bewerken, deze ook van een watermerk wordt voorzien. Zoals het bedrijf uitlegt, kan het alleen maar zeggen dat Claude waarschijnlijk ooit bij de tekst betrokken was. Zelfs vertalingen krijgen een watermerk. Als Claude de tekst alleen heeft proefgelezen en licht bewerkt, of als de tekst te kort is, is het watermerk mogelijk niet voldoende om detecteerbaar te zijn. Houd er rekening mee dat het licht bewerken van door Claude gegenereerde tekst het watermerk waarschijnlijk niet zal verwijderen. Als je het zeker wilt weten, moet je het volledig herschrijven.
Er zijn enige zorgen geweest over de manier waarop watermerken de code zouden beïnvloeden, aangezien er mogelijk geen auteursrecht op kan rusten zonder aanzienlijke menselijke inbreng. Als iemand zou kunnen bewijzen dat een hele codebase door AI is gegenereerd, kunnen ze deze kopiëren en vervolgens herhalen. Anthropic zei echter dat die code "over het algemeen minder watermerken heeft dan sommige andere vormen van tekst", omdat deze doorgaans exacte uitvoer vereist. Als er geen keuzes gemaakt hoeven te worden bij het genereren van tekst, kan er geen watermerk worden toegepast.
Anthropic zal afbeeldingen ook van een watermerk voorzien door een cryptografisch ondertekende notitie in de metadata toe te voegen waarin staat dat deze door Claude is gegenereerd. In de aankondiging zei het bedrijf dat het bij de lancering watermerken toepaste op alle producten van Claude, omdat het niet over goede manieren beschikt om de veranderingen per regio door te voeren. De wijzigingen zullen van invloed zijn op de output van alle Claude-producten die modellen gebruiken die na 2 augustus zijn uitgebracht. Anthropic zal de komende maanden ook watermerkmogelijkheden toevoegen aan oudere Claude-modellen.
Het bedrijf legde uit dat grote taalmodellen bij het genereren van tekst één woord tegelijk kiezen door te kiezen uit een lijst met mogelijk geschikte woorden om te gebruiken. Ze kiezen woorden willekeurig, zolang ze maar zinvol zijn voor de context van wat ze genereren. Als het watermerk is ingeschakeld, gebruikt Claude een sleutel om te beslissen welk woord hij moet kiezen, in plaats van een willekeurige generator voor willekeurige getallen te gebruiken om het volgende woord te kiezen.
In zijn voorbeeld gebruikte Anthropic de cijfers van pi als sleutel. Stel dat de sleutel begint met het cijfer 2 uit de pi-reeks 3.1415926535. Het volgende gegenereerde woord is het zesde in de keuzelijst, dan het vijfde, het derde en dan weer het vijfde. Deze methode is een aanpassing van de SynthID-Text-benadering van watermerken van Google DeepMind, die het team beschreef in een artikel gepubliceerd in Nature. Watermerken hebben geen invloed op de kwaliteit van Claude's productie en vertragen deze ook niet, aldus het bedrijf. Bovendien zijn er geen extra tokens nodig en worden generaties niet duurder.
Natuurlijk heeft AI-gegenereerd proza doorgaans aanwijzingen. Modellen gebruiken graag bepaalde zinsconstructies, zoals 'dit is niet [X], maar [Y]'. Maar deze aanwijzingen zijn alleen voldoende om u te laten weten dat er een AI betrokken was bij het schrijven van die tekst, en niet het gebruikte model. Anthropic zal een API vrijgeven die "sleutels" heeft om Claude's watermerken te decoderen en zal kunnen zeggen of de AI het tekstblok heeft gegenereerd dat wordt gecontroleerd.
Anthropic geeft toe dat de methode voor het watermerken van tekst beperkingen kent. Het kan niet zeggen of Claude de tekst daadwerkelijk heeft geschreven of deze alleen heeft bewerkt, wat betekent dat als je de AI vraagt om iets voor je te bewerken, deze ook van een watermerk wordt voorzien. Zoals het bedrijf uitlegt, kan het alleen maar zeggen dat Claude waarschijnlijk ooit bij de tekst betrokken was. Zelfs vertalingen krijgen een watermerk. Als Claude de tekst alleen heeft proefgelezen en licht bewerkt, of als de tekst te kort is, is het watermerk mogelijk niet voldoende om detecteerbaar te zijn. Houd er rekening mee dat het licht bewerken van door Claude gegenereerde tekst het watermerk waarschijnlijk niet zal verwijderen. Als je het zeker wilt weten, moet je het volledig herschrijven.
Er zijn enige zorgen geweest over de manier waarop watermerken de code zouden beïnvloeden, aangezien er mogelijk geen auteursrecht op kan rusten zonder aanzienlijke menselijke inbreng. Als iemand zou kunnen bewijzen dat een hele codebase door AI is gegenereerd, kunnen ze deze kopiëren en vervolgens herhalen. Anthropic zei echter dat die code "over het algemeen minder watermerken heeft dan sommige andere vormen van tekst", omdat deze doorgaans exacte uitvoer vereist. Als er geen keuzes gemaakt hoeven te worden bij het genereren van tekst, kan er geen watermerk worden toegepast.
Anthropic zal afbeeldingen ook van een watermerk voorzien door een cryptografisch ondertekende notitie in de metadata toe te voegen waarin staat dat deze door Claude is gegenereerd. In de aankondiging zei het bedrijf dat het bij de lancering watermerken toepaste op alle producten van Claude, omdat het niet over goede manieren beschikt om de veranderingen per regio door te voeren. De wijzigingen zullen van invloed zijn op de output van alle Claude-producten die modellen gebruiken die na 2 augustus zijn uitgebracht. Anthropic zal de komende maanden ook watermerkmogelijkheden toevoegen aan oudere Claude-modellen.

