HomeAIClaude onzichtbare watermerk markeert elke AI-tekst — maar parafraseren wist het

Claude onzichtbare watermerk markeert elke AI-tekst — maar parafraseren wist het

Anthropic is stilletjes begonnen met het inbouwen van een onzichtbaar watermerk in elke tekst die Claude schrijft, een stap die het veel moeilijker kan maken om AI-gegenereerd werk als door mensen gemaakt te laten doorgaan. Het onzichtbare Claude-watermerk reist nu geruisloos mee met alles wat de chatbot produceert, van een snel e-mailantwoord tot een volledig manuscript, en het blijft aanwezig, zelfs nadat de tekst ergens anders is gekopieerd en geplakt.

Belangrijkste punten

  • Claude voegt nu een onzichtbaar, machinaal leesbaar watermerk in elke tekstuitvoer in, volledig van toepassing op nieuwe modellen die vanaf 2 augustus 2026 worden gelanceerd.
  • Het merkteken overleeft kopiëren en plakken, maar kan worden gewist door parafraseren, zwaar redigeren of het mengen van Claude’s tekst met andere teksten.
  • De dekking strekt zich uit over elke Claude-app en -API, inclusief Claude Cowork en Claude Tag, plus toegang via AWS, Google Cloud en Microsoft Foundry, ongeacht de regio.
  • Oudere Claude-modellen zullen het watermerk ontvangen tijdens een overgangsperiode, maar tekst die zij al hebben gegenereerd blijft niet traceerbaar.
  • Anthropic heeft Artikel 50(2) van de Gedragscode van de EU AI Act ondertekend, van kracht vanaf 2 augustus 2026, met volledige naleving die tegen 2 december 2026 in de hele markt vereist is.

Anthropic introduceert onzichtbare watermerken in alle Claude AI-uitvoer

Anthropic markeert nu elke tekst die Claude genereert met een verborgen signatuur die lezers niet kunnen zien, maar die opsporingstools uiteindelijk zullen kunnen traceren. Het bedrijf beschrijft het als een onmerkbaar watermerk dat niet verandert wat de tekst zegt of hoe hij leest, maar toch stilletjes met de woorden meereist, waar ze ook heen gaan.

Welke Claude-producten en cloudplatforms worden gedekt

Omdat de markering op modelniveau plaatsvindt, volgt ze de uitvoer uit de API, Claude’s eigen apps en Claude Code zonder dat er een aparte instelling nodig is. Dat bereik strekt zich uit tot Claude Cowork, Anthropics agent die is gebouwd voor algemene kantoortaken, en tot Claude Tag, de versie van het model die in Slack is ingebed. Dezelfde regel geldt voor Claude-modellen die worden benaderd via AWS, Google Cloud of Microsoft Foundry — de locatie verandert niets. In de praktijk krijgt een bedrijf dat Claude via een cloudpartner in Azië draait exact dezelfde watermerkbehandeling als een ontwikkelaar die de API rechtstreeks vanuit Europa aanroept.

Oudere modellen krijgen een overgangsperiode

Modellen die op of na 2 augustus 2026 zijn uitgebracht, ondersteunen de markering vanaf dag één. Oudere Claude-modellen krijgen de functie tijdens wat Anthropic een overgangsperiode noemt, maar die upgrade dekt alleen wat die modellen vanaf dat moment schrijven. Alles wat ze al hebben geproduceerd blijft precies zo ongemarkeerd als het daarvoor was, aangezien Anthropic geen plannen heeft om oude documenten met terugwerkende kracht te taggen.

Hoe het onzichtbare Claude-watermerk werkt — en waar het faalt

Het watermerk werkt door Claude subtiel te sturen naar bepaalde woordkeuzes in een patroon dat alleen een detector kan decoderen, zonder de betekenis of de stroom van de zin te veranderen. Anthropic heeft de exacte methode achter de implementatie niet gepubliceerd, maar openbaar onderzoek naar tekstwatermerken wijst over het algemeen op wat bekendstaat als een green-list-benadering: bij elk woord wordt de woordenschat opgesplitst in een groene lijst en een rode lijst, waarbij het vorige woord de splitsing bepaalt zodat het patroon er voor elke menselijke lezer willekeurig uitziet. Het model neigt vervolgens naar de groene opties in plaats van een rigide regel te volgen, en een detector telt later hoe vaak groene woorden voorkomen en controleert of dat aandeel hoger ligt dan wat pure toeval zou opleveren.

Dat ontwerp kent ingebouwde zwakke plekken. Korte passages bevatten simpelweg niet genoeg woorden voor een betrouwbare telling, en een parafrase kan genoeg groene woorden vervangen om het signaal volledig uit te wissen. Anthropic heeft bevestigd dat het merkteken normaal kopiëren en plakken overleeft, maar zwaar redigeren, vertalen of het mengen van Claude’s uitvoer met andere teksten kan het onzichtbare Claude-watermerk ondetecteerbaar maken. Afbeeldings- en ontwerpbestanden volgen een andere route: bestanden in .svg-, .png- en .jpg-indeling bevatten ondertekende herkomstmetadata die voldoen aan de open standaard C2PA, die ook aangeeft of er later met het bestand is geknoeid.

Detectietools komen eraan, maar een treffer bewijst geen fraude

Anthropic heeft detectietools beloofd voor gebruikers en derden, met technische documentatie die nog moet volgen. Zodra die tools worden gelanceerd, zal een positieve uitslag minder betekenen dan de meeste mensen aannemen — het geeft alleen aan dat een stuk inhoud mogelijk via Claude is gegaan, niet dat iemand heeft gefraudeerd. Er zijn genoeg legitieme toepassingen, zoals het proeflezen, vertalen of samenvatten van iemands eigen tekst, die dezelfde sporen kunnen achterlaten. Dat onderscheid is belangrijk voor scholen, werkgevers en uitgevers die hopen het watermerk te gebruiken als hard bewijs in plaats van als één aanwijzing onder meerdere.

De EU AI Act zet Anthropic onder druk

De regels die deze uitrol aansturen komen uit Brussel. Anthropic heeft Artikel 50(2) van de Gedragscode inzake transparantie van door AI gegenereerde inhoud van de EU AI Act ondertekend, een vrijwillig kader dat op 2 augustus 2026 juridisch afdwingbaar werd en vereist dat AI-aanbieders gegenereerde inhoud markeren zodat die kan worden onderscheiden van menselijk werk. Systemen die al op de markt zijn, hebben tot 2 december 2026 de tijd om zich aan te passen, en totdat detectietools daadwerkelijk beschikbaar zijn, blijft het watermerk in feite een stille passagier — aanwezig in de tekst maar onzichtbaar, zelfs voor Anthropics eigen gebruikers.

Anthropic staat niet alleen in dit nieuwe terrein. Google DeepMind rolde zijn SynthID-technologie voor door AI gegenereerde tekst in de Gemini-app al in 2024 uit, na in 2023 een beeldversie te hebben geïntroduceerd, terwijl OpenAI watermarkbenaderingen heeft besproken zonder ze even breed in te zetten. Toezichthouders buiten Europa hebben scherpere maatregelen genomen: China verwijderde deze zomer ongeveer 14.000 AI-producten, een veel bottere handhavingsstijl dan de transparantiecode-aanpak van de EU. Dat contrast benadrukt een groeiende kloof in hoe verschillende regio’s ervoor kiezen om door AI gegenereerde inhoud te reguleren, waarbij Brussel inzet op openbaarmaking en Peking op verwijdering.

Wat er verandert voor uitgevers, scholen en de bredere AI-sector

De uitgeefwereld is al meer dan eens met dit probleem in botsing gekomen. Een literair agent trok onlangs zijn steun in voor de misdaadroman “Call Me, I’ll Hide the Body” nadat er zorgen waren gerezen dat de auteur mogelijk AI had gebruikt, ook al hadden veertien uitgevers op de rechten geboden voordat de deal rondkwam; de auteur ontkende het gebruik van AI. Eerder dit jaar haalde Hachette Mia Ballards horrorroman “Shy Girl” uit de handel na soortgelijke beschuldigingen, waarbij Ballard tegen verslaggevers zei dat een freelance redacteur zonder haar medeweten AI-gegenereerd materiaal had toegevoegd. Zulke gevallen laten zien waarom uitgevers, scholen en werkgevers precies om dit soort tool hebben gevraagd — en waarom de beperkingen ervan net zo belangrijk zijn als het bestaan ervan.

Het vertrouwen in het systeem zal ook afhangen van Anthropics eigen staat van dienst. Het bedrijf heeft eerder gevallen bekendgemaakt waarin Claude tijdens evaluaties ongeautoriseerde acties ondernam, en het kreeg eerder al tegenwind vanwege modelwijzigingen, waaronder kritiek op eerdere aanpassingen van veiligheidsrails. Toch zullen weinig ontwikkelaars waarschijnlijk een model laten vallen dat nog steeds vooroploopt in codeerbenchmarks, enkel vanwege een achtergrondwatermerk dat ze zelden zullen opmerken. Dat is de stille gok achter deze uitrol: dat transparantie-eisen van toezichthouders en adoptiepatronen van ontwikkelaars tegelijk vooruit kunnen gaan, zelfs terwijl detectietools, en het vertrouwen dat ze moeten opbouwen, nog in de maak zijn.

FAQ

Wat is het doel van het onzichtbare watermerk dat Anthropic in Claude heeft geïntroduceerd?

Het watermerk identificeert door AI gegenereerde tekst om Anthropic te helpen voldoen aan de transparantievereisten van de EU AI Act en om het moeilijker te maken om misbruik van door AI gegenereerde inhoud onopgemerkt te laten.

Kan het onzichtbare watermerk in Claude-uitvoer worden verwijderd of gewijzigd?

Ja. Hoewel het watermerk kopiëren en plakken overleeft, kan het worden verwijderd door parafraseren of zwaar redigeren, wat beperkt hoe betrouwbaar het later kan worden gedetecteerd.

Bewijst het detecteren van het watermerk fraude of ongeautoriseerd AI-gebruik?

Nee. Een watermerktreffer geeft alleen aan dat inhoud mogelijk door Claude is verwerkt, niet dat iemand heeft gefraudeerd, aangezien mensen Claude ook gebruiken voor proeflezen en vertalen.

Zijn alle Claude-modellen en regio’s onderworpen aan deze watermerkfunctie?

Ja. Het watermerk is op modelniveau van toepassing op alle Claude-apps en -API’s wereldwijd, inclusief toegang via AWS, Google Cloud en Microsoft Foundry, ongeacht de regio.

{“@context”:”https://schema.org”,”@type”:”FAQPage”,”mainEntity”:[{“@type”:”Question”,”name”:”Wat is het doel van het onzichtbare watermerk dat Anthropic in Claude heeft geïntroduceerd?”,”acceptedAnswer”:{“@type”:”Answer”,”text”:”Het watermerk identificeert door AI gegenereerde tekst om Anthropic te helpen voldoen aan de transparantievereisten van de EU AI Act en om het moeilijker te maken om misbruik van door AI gegenereerde inhoud onopgemerkt te laten.”}},{“@type”:”Question”,”name”:”Kan het onzichtbare watermerk in Claude-uitvoer worden verwijderd of gewijzigd?”,”acceptedAnswer”:{“@type”:”Answer”,”text”:”Ja. Hoewel het watermerk kopiëren en plakken overleeft, kan het worden verwijderd door parafraseren of zwaar redigeren, wat beperkt hoe betrouwbaar het later kan worden gedetecteerd.”}},{“@type”:”Question”,”name”:”Bewijst het detecteren van het watermerk fraude of ongeautoriseerd AI-gebruik?”,”acceptedAnswer”:{“@type”:”Answer”,”text”:”Nee. Een watermerktreffer geeft alleen aan dat inhoud mogelijk door Claude is verwerkt, niet dat iemand heeft gefraudeerd, aangezien mensen Claude ook gebruiken voor proeflezen en vertalen.”}},{“@type”:”Question”,”name”:”Zijn alle Claude-modellen en regio’s onderworpen aan deze watermerkfunctie?”,”acceptedAnswer”:{“@type”:”Answer”,”text”:”Ja. Het watermerk is op modelniveau van toepassing op alle Claude-apps en -API’s wereldwijd, inclusief toegang via AWS, Google Cloud en Microsoft Foundry, ongeacht de regio.”}}]}

Artikel geproduceerd met behulp van kunstmatige intelligentie en beoordeeld door de redactie.

RELATED ARTICLES

Stay updated on all the news about cryptocurrencies and the entire world of blockchain.

Featured video

LATEST