Anthropic introduceert onzichtbare watermerken in Claude: van passieve detectie naar actieve traceerbaarheid van content

Bewerkt door: Svitlana Velhush

Every Claude text now has a watermark. It survives copy-paste. Anthropic rolled out invisible marks for the EU AI Act: - Statistical signal baked into the text - Holds up through light editing - Applied worldwide, not just EU users Your AI-written docs just got traceable.

Reply

Op 2 augustus 2026 is Anthropic begonnen met het inbouwen van onzichtbare watermerken in nieuwe versies van Claude — machineleesbare labels die in de statistische verdeling van de tekst blijven en behouden blijven bij kopiëren en gedeeltelijke bewerking. Dit is niet zomaar een technische update, maar een strategische verschuiving van pogingen om AI-content achteraf te detecteren naar het proactief inbouwen van bewijs van herkomst al in de generatiefase.

Het mechanisme werkt op tokenniveau: het model past de waarschijnlijkheid van woordkeuzes aan zodat er in de sequentie een statistisch detecteerbaar patroon ontstaat dat geen invloed heeft op de betekenis, kwaliteit of leesbaarheid. Het bedrijf belooft tools voor verificatie, maar de details van het algoritme en de weerstand tegen aanvallen (vertaling, parafrasering, vermenging met menselijke tekst) zijn nog niet volledig onthuld. In tegenstelling tot eerdere benaderingen die gebaseerd waren op analyse van stijl en frequentie, is het watermerk van Anthropic een actief signaal dat door de producent is ingebouwd.

De methodologie van Anthropic is gebaseerd op de vereisten van artikel 50 van de EU AI Act, die precies op 2 augustus van kracht zijn geworden. De toezichthouder vereist dat systemen voor generatieve AI machineleesbare labels toevoegen om AI-content te identificeren. Dit verklaart de gelijktijdigheid met andere spelers: Google breidt SynthID uit naar tekst, OpenAI promoot C2PA en digitale watermerken, Meta test soortgelijke oplossingen. Anthropic onderscheidt zich echter door het watermerk direct te koppelen aan compliance, en niet alleen aan interne veiligheidsinitiatieven.

In vergelijking met traditionele AI-detectoren (die perplexiteit en burstiness analyseren), geeft het watermerk een betrouwbaarder signaal over een specifiek model, maar het lost het probleem van gemengd auteurschap niet op. Een onderzoek dat op 8 augustus op arXiv werd gepubliceerd, benadrukt: in het tijdperk van human-AI collaboration is de binaire verdeling 'mens of AI' verouderd. Het watermerk legt het feit vast dat Claude is gebruikt, maar laat niet zien welk deel van de tekst van een mens is, welke wijzigingen zijn aangebracht en wie de uiteindelijke verantwoordelijkheid draagt.

De beperkingen zijn duidelijk. Grootschalige bewerking, vertaling of vermenging met andere content kan het signaal vernietigen. Het ontbreken van een watermerk bewijst geen menselijk auteurschap — het betekent alleen dat het label ofwel niet was ingebouwd, ofwel was verwijderd. De tool is dus nuttig voor platforms en uitgevers als extra signaal, maar niet als 'onweerlegbaar bewijs'.

Voor de sector betekent dit een overgang naar een ecosysteem van provenance: in de toekomst zullen modellen niet alleen tekst genereren, maar ook cryptografisch verifieerbare sporen achterlaten. Dit zal moderatie vereenvoudigen, maar vragen over auteurschap, citaten en juridische aansprakelijkheid compliceren. Onderzoekers moeten nog antwoord geven op de vraag hoe watermerken van verschillende aanbieders zullen interageren en of er een universele standaard voor detectie kan worden gecreëerd.

Uiteindelijk laten de watermerken van Anthropic zien dat regelgeving de technische agenda al bepaalt: de traceerbaarheid van content wordt een verplichte eigenschap van modellen, in plaats van een optionele functie.

26 Weergaven

Bronnen

  • 隐形水印上线,AI写作开始留痕

Lees meer artikelen over dit onderwerp:

This feels like another “DeepSeek” moment coming out of China. ByteDance just released Seed 2.0, also called Doubao 2.0, and it’s apparently outperforming top tier models across multimodal tasks, advanced math, STEM benchmarks, and even agent style reasoning. On top of that,

Image
Reply
Heb je een fout of onnauwkeurigheid gevonden?We zullen je opmerkingen zo snel mogelijk in overweging nemen.