Anthropic heeft een watermerk geïntroduceerd voor door Claude gegenereerde tekst om te voldoen aan de vereisten van de EU AI Act, die voorschrijft dat synthetische inhoud op een machineleesbare manier duidelijk gemarkeerd moet zijn. Het bedrijf stelt dat de techniek door AI geschreven tekst markeert zonder het model te vertragen of extra tokens te gebruiken, een bewering die toezichthouders en concurrenten binnenkort zullen testen.
Waarom het watermerk belangrijk is
Het watermerk verweeft woordkeuzes met een privésleutel en de omliggende context. Lezers kunnen het patroon niet zien, maar een verifieerder die de sleutel kent, kan het wel herkennen. In de praktijk scant een tool in een latere fase een document en rapporteert of Claude het heeft geproduceerd.
Regeldruk
De EU AI Act verplicht aanbieders van generatieve systemen om detecteerbare signalen in synthetische inhoud in te bedden.
Zakelijke afwegingen
Bedrijven wegen drie zorgen af bij de beslissing om dergelijke markeringen over te nemen:
- Beperkingen in traceerbaarheid – Het watermerk bevestigt dat de tekst afkomstig is van een AI-model, maar het kan de output niet koppelen aan een specifieke gebruiker of account. Die lacune laat de verantwoordelijkheid open wanneer door AI gegenereerde inhoud wordt misbruikt.
- Omzetrisico – Sommige aanbieders vrezen dat zichtbare watermerken tot een derde van hun klantenbestand zullen afschrikken, die de voorkeur geven aan ongemerkte tekst om concurrentie- of privacyredenen.
- Technische beperkingen – Het inbedden van een patroon kan de creativiteit van de output van het model enigszins verminderen, vooral bij zeer korte fragmenten waar het watermerk minder woorden heeft om mee te werken. Gebruikers kunnen het signaal ook verzwakken door delen van de tekst handmatig te herschrijven, waardoor detectie moeilijker wordt.
Anthropic zet erop in dat hun aanpak de meeste van deze nadelen omzeilt. Door de sleutel in het proces van tokenselectie te verweven, beweert het bedrijf dat er geen vertraging optreedt en geen extra tokenkosten zijn, waardoor de gebruikerservaring die betalende klanten verwachten behouden blijft.
Technische uitdagingen
Detecteerbaarheid hangt af van het feit of de verifieerder over dezelfde privésleutel beschikt als die tijdens de generatie is gebruikt. Korte teksten blijven een zwak punt omdat het statistische patroon minder uitgesproken is, wat de kans op fout-negatieven vergroot. Het watermerk voorkomt ook geen bewerkingen in een latere fase; een gebruiker die de helft van de paragraaf herschrijft, kan de markering effectief wissen.
Conclusie: Het watermerk van Anthropic beantwoordt een nieuw wettelijk mandaat, maar de impact ervan zal afhangen van hoe goed het de balans vindt tussen detecteerbaarheid, verminderde flexibiliteit en het risico op omzeiling.
