Live News

In het kort Een rechter in Washington heeft Kalshi bevolen te stoppen met het aanbieden van weddenschappen op sport, verkiezingen, politiek, entert...

Gedecentraliseerd financieringsprotocol (DeFi) Neutrl heeft de uitgifte en aflossing van zijn synthetische NUSD-dollar opgeschort nadat niet-gespec...

Figure Technology Solutions rapporteerde voor het tweede kwartaal een volume van $4,3 miljard aan consumentenleningen, een stijging van 132% ten op...

14/08/26

Volg ons:

Anthropic geeft stilletjes elke Claude AI-uitvoer een watermerk. Bouwers proberen het al te doorbreken

Anthropic geeft stilletjes elke Claude AI-uitvoer een watermerk. Bouwers proberen het al te doorbreken
Default Door Remote - 13 Aug 2026
In het kort

Nieuwe Claude-modellen die op of na 2 augustus 2026 in de EU zijn gelanceerd, bevatten een machinaal leesbaar watermerk in elk stukje gegenereerde tekst, toegepast op modelniveau.

De markeringen zijn wereldwijd van toepassing op Claude, de API, Claude Code en cloudpartners.

Open-sourceprojecten om ze te verwijderen verschenen binnen enkele dagen.

Anthropic is begonnen met het inbedden van een onmerkbaar watermerk in alle tekst die zijn nieuwste Claude-modellen genereren. De wijziging werd van kracht voor modellen die op 2 augustus 2026 in de EU werden gelanceerd, en Anthropic zegt dat deze wereldwijd van toepassing zal zijn.

Anthropic heeft het plan uiteengezet in een ondersteunend artikel na ondertekening van de Praktijkcode over transparantie van de EU AI Act. Met andere woorden, het is niet bepaald vrijwillig om dit te doen. Het merk bereikt elk Claude-oppervlak, van de chatbot en API tot Claude Code en cloudpartners zoals AWS, Google Cloud en Microsoft Foundry.

Myriad: Wanneer zal OpenAI GPT-6 uitbrengen? Klik om uw voorspelling te doen. "Wanneer een ondersteund Claude-model tekst genereert, weeft het een onmerkbaar watermerk rechtstreeks in de tekst zelf. U zult het niet zien en het verandert niets aan de betekenis, kwaliteit of leesbaarheid van Claude's reactie", aldus Anthropic. "Omdat het watermerk deel uitmaakt van de tekst, zal het met de tekst meereizen wanneer het ergens anders wordt gekopieerd en geplakt, en kan het na enige bewerking blijven bestaan."

Het is dus een beetje complexer dan de gebruikelijke methoden waar gebruikers aan denken. Wanneer een ondersteund Claude-model tekst schrijft, weeft het een onmerkbaar watermerk rechtstreeks in de woorden, zonder zichtbare tag. Omdat het merkteken deel uitmaakt van de tekst, overleeft het het kopiëren en plakken en, geeft Anthropic toe, "kan na enige bewerking blijven bestaan." Bestanden krijgen een tweede laag: ondertekende metadata onder de open standaard C2PA (denk aan een digitaal verzendmanifest waarin wordt vastgelegd wie een bestand heeft geproduceerd en of iemand het daarna heeft gewijzigd).

De methode blijft geheim Anthropic heeft niet gezegd hoe het watermerk wordt gemaakt. Het ondersteuningsartikel noemt het modelniveau (het model wordt ermee getraind) en tekst-native (het is bijvoorbeeld geen externe tool zoals een metadatagenerator), maar de detectiedocumentatie en de exacte techniek zijn nog niet beschikbaar.

Onderzoekers concluderen dat het een statistische signatuur is: het model stuurt zijn woordkeuzes naar een zwakke, waarneembare bias, dezelfde familie van benaderingen die Google gebruikt in SynthID Text. Dat blijft een gok totdat Anthropic de detector publiceert.

Maar dat duwt privacyliefhebbers niet terug, en sommige experts werken al aan methoden om de geheime watermerken van Anthropic te doorbreken. mikiane/claude-watermark-cleaner (106 sterren op Github) scrubt onzichtbare Unicode en herschrijft vervolgens tekst met een niet-Claude-model om het tokenpatroon te verstoren.

Een groter project, guillaumemeyer/watermerken-verwijderaar (4,6k sterren op Githum), verwijdert Claude-tekstmarkeringen plus C2PA- en SynthID-klasse signalen in PNG, JPEG, SVG, PDF en DOCX. De auteurs beweren dat een statistisch tekstteken "geen betrouwbare manier is om de herkomst te bewijzen" en gebruikers er vooral toe aanzet om een ​​tweede modelpas te gebruiken om hun eigen schrift schoon te maken. Er kan geen verwijdering worden gegarandeerd totdat Anthropic de detector en drempels verzendt.

De eigen geschiedenis van Anthropic maakt de privacyreactie scherper. Het bedrijf verwijderde in maart een verborgen Claude Code-tracker nadat onderzoekers ontdekten dat deze de locatie en het proxygebruik van sommige gebruikers tagde via niet-openbaar gemaakte Unicode-markeringen - dezelfde stille markeringstechniek die nu centraal staat in het watermerkplan.

Het merkteken bewijst dat Claude de tekst in handen heeft gehad, en niet dat hij het hele stuk heeft geschreven. Daarom wordt een origineel handschrift met een kleine bewerking op dezelfde manier behandeld als een volledig door AI gegenereerde tekst. Vraag Claude om uw paragraaf te proeflezen of te vertalen en de uitvoer kan het signaal nog steeds dragen. Anthropic is duidelijk dat door zware montage het kan worden weggenomen, en dat een ontbrekend merkteken niet bewijst dat een mens iets heeft geschreven.

Een Amerikaans wetsvoorstel, de COPIED Act, brengt hetzelfde idee naar voren: een gestandaardiseerde manier om AI-inhoud van een watermerk te voorzien, zodat platforms de oorsprong ervan kunnen traceren. Zoals het chantageprobleem van Claude aantoonde, wordt er bij de modellen van het bedrijf al intensief gekeken naar wat ze doen met de tekst die ze aanraken.

Anthropic heeft niet gezegd wanneer het de detectietools zal publiceren waarmee iedereen het merkteken kan verifiëren.

Dagelijkse debriefing NieuwsbriefBegin elke dag met de belangrijkste nieuwsverhalen van dit moment, plus originele artikelen, een podcast, video's en meer. Uw e-mail Download het! Download het!