AI & computing › Generatieve AI & synthetische media
Claude watermerkt voortaan alle AI-gegenereerde tekst en beelden wereldwijd
AI-bedrijf Anthropic gaat de output van chatbot Claude wereldwijd voorzien van een watermerk. De maatregel is een reactie op de Europese AI-verordening, die eist dat AI-content herkenbaar moet zijn. Tekst krijgt een onzichtbaar statistisch watermerk, afbeeldingen een digitale handtekening in de bestandsgegevens.
Onzichtbare handtekening in tekst
Anthropic heeft de Europese Gedragscode voor Transparantie van AI-gegenereerde Content ondertekend, een vrijwillige regeling die voortvloeit uit artikel 50(2) van de Europese AI-verordening. Die eist dat aanbieders van generatieve AI hun output herkenbaar maken als kunstmatig gemaakt of bewerkt. Ongeveer 190 partijen, waaronder Anthropic, hebben de code inmiddels ondertekend.
Voor tekst gebruikt Anthropic een variant van SynthID-Text, een techniek die oorspronkelijk is ontwikkeld door Google DeepMind. Bij het genereren van tekst kiest een taalmodel telkens een volgend woord uit meerdere mogelijkheden die qua betekenis vaak gelijkwaardig zijn. Normaal gebeurt die keuze willekeurig. Met het watermerk stuurt een geheime sleutel die keuze subtiel, zodat er over veel woorden een statistisch patroon ontstaat. De tekst blijft voor lezers volstrekt normaal, maar een detector met de juiste sleutel kan het patroon herkennen. Anthropic benadrukt dat de methode geen extra tekens toevoegt, de kwaliteit niet beïnvloedt en geen persoonlijke gegevens van gebruikers bevat.
Ook beelden krijgen een stempel
Voor afbeeldingen kiest Anthropic een andere aanpak. Bestanden in formaten als PNG, JPG en SVG krijgen een cryptografisch ondertekende vermelding in hun metadata, volgens de open standaard C2PA. Die vermelding laat zien dat Claude bij de creatie of bewerking van het bestand betrokken was. Het beeld zelf verandert niet, maar omdat de handtekening cryptografisch is vastgelegd, is ook te zien of het bestand later is aangepast.
De watermerking geldt voor alle Claude-modellen die vanaf 2 augustus 2026 zijn gelanceerd, in elke tak van het bedrijf: de Claude-apps, de ontwikkelaars-API, de programmeertool Claude Code en de samenwerkingsdienst Claude Cowork. Ook producten van andere bedrijven die op Claude's technologie draaien, krijgen automatisch het watermerk, omdat het in de output zelf verwerkt zit. Oudere modellen krijgen de functie de komende maanden. Hoewel de Europese wet de directe aanleiding is, past Anthropic het watermerk wereldwijd toe, omdat het naar eigen zeggen nog geen betrouwbare manier heeft om de maatregel tot één regio te beperken.
Grenzen aan de betrouwbaarheid
Een systeem om watermerken te herkennen, is er nog niet volledig: Anthropic werkt aan een detectie-API maar heeft de werking nog niet afgerond. Belangrijker is dat het bedrijf zelf toegeeft dat een gevonden watermerk geen bewijs is dat een tekst volledig door AI is geschreven. Het merk verklapt alleen dát Claude ergens bij betrokken was, niet in welke mate. Een grondig herschreven of vertaalde tekst kan het statistische patroon grotendeels verliezen, waardoor het watermerk in de praktijk te omzeilen is door de tekst stevig te herschrijven.
Achtergrond & begrippen
Wat betekent dit voor de toekomst? Watermerken zoals dat van Claude kunnen het makkelijker maken om nepnieuws, misleidende beelden en AI-gegenereerde propaganda te herkennen. Tegelijk blijft de bescherming beperkt: wie tekst grondig herschrijft, omzeilt de detectie alsnog. De maatregel is vooral een eerste stap in een langere zoektocht naar betrouwbare herkenning van AI-content.
- AI Act
- De Europese verordening die regels stelt aan de ontwikkeling en het gebruik van kunstmatige intelligentie, waaronder transparantie-eisen voor AI-gegenereerde content.
- SynthID-Text
- Een watermerktechniek van Google DeepMind die de woordkeuzes van een taalmodel subtiel stuurt om een detecteerbaar statistisch patroon te creëren.
- C2PA
- Een open standaard waarmee bestanden een cryptografisch ondertekende herkomstvermelding krijgen, zodat te zien is of en hoe AI bij het maken ervan betrokken was.
- Watermerk
- Een onzichtbaar of verborgen kenmerk in digitale content waarmee de herkomst ervan later kan worden vastgesteld.
- Metadata
- Gegevens over een bestand, zoals makerinformatie, die los staan van de eigenlijke inhoud maar er wel aan gekoppeld zijn.
- Detectie-API
- Een online dienst waarmee andere programma's kunnen controleren of een stuk tekst of een bestand een AI-watermerk bevat.
Bronnen
Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.