Het watermerk van Anthropic heeft een privacyprobleem

De nieuwe watermark-detectie API van Anthropic dwingt ontwikkelaars, scholen en bedrijven om volledige documenten naar hun servers te uploaden, waardoor een transparantietool verandert in een potentieel privacyrisico.

Hoe het watermerk werkt

Anthropic verwerkt een onzichtbaar patroon in elke door Claude gegenereerde tekst door de woordkeuze te beïnvloeden met een geheime sleutel. Het kan bijvoorbeeld "grijs" vervangen door "bewolkt" volgens een verborgen schema dat voor mensen niet zichtbaar is. Alleen het detectiesysteem van Anthropic kan het patroon lezen, en dit zal vanaf 2 augustus 2026 actief zijn voor alle Claude-modellen.

De verificatie-pipeline

Om te bewijzen dat een tekstfragment het watermerk bevat, roepen gebruikers de detectie-API van Anthropic aan en sturen ze het volledige document naar het cloud-endpoint van het bedrijf. De dienst voert een eigen algoritme uit en geeft een simpel ja/nee-antwoord terug.

Waarom dat ertoe doet

De uploadvereiste draagt de volledige inhoud over aan een externe AI-provider. Universiteiten die essays scannen, HR-afdelingen die sollicitatiebrieven controleren en advocatenkantoren die contracten beoordelen, lopen allemaal het risico bloot te leggen:

  • Academisch onderzoek en ongepubliceerde gegevens
  • Persoonlijke verklaringen, cv's en aanbevelingsbrieven
  • Interne memo's, strategische plannen of financiële prognoses
  • Vertrouwelijke juridische overeenkomsten

Anthropic stelt dat het watermerk zelf geen gebruikersidentiteit codeert, maar de ruwe tekst staat nu wel op de infrastructuur van Anthropic. Door zowel de generatiezijde (waar het watermerk wordt ingevoegd) als de verificatiezijde (waar de tekst wordt onderzocht) te controleren, krijgt het bedrijf een enkele pipeline die enorme hoeveelheden eigendomsrechtelijke of persoonlijk identificeerbare informatie kan verzamelen.

Beperkingen in beveiliging en effectiviteit

Zelfs als privacyzorgen zouden verdwijnen, is de robuustheid van het watermerk wankel. Een paar woordwijzigingen wissen het patroon al. Het door een ander AI-model laten herschrijven van de tekst verwijdert ook het signaal. Open-source tools verwijderen het watermerk al uit de output van Claude. Als gevolg hiervan markeert de detectie-API mogelijk alleen kopieën met weinig inspanning, terwijl geavanceerde gebruikers het omzeilen, waardoor gegevens worden blootgesteld zonder dat daar een evenredig beveiligingsvoordeel tegenover staat.

Wie verliest er, wie wint er

  • Docenten en werkgevers: Een snelle check van het type "is dit door AI geschreven?" heeft de verborgen prijs van het versturen van studentenwerk of sollicitatiemateriaal naar een commercieel AI-lab.
  • Bedrijven die met gevoelige documenten werken: Juridische teams en bedrijfscommunicatie riskeren bedrijfsgeheimen of vertrouwelijke informatie bloot te leggen aan een externe dienst.

Waar u op moet letten

  • Beleid en contractvoorwaarden: Klanten moeten de data-retentie- en gebruiksvoorwaarden van Anthropic nauwkeurig controleren om te zien of geüploade teksten worden bewaard, gedeeld of gebruikt voor training.
  • Alternatieve verificatiemethoden: Er zouden open-source watermerkdetectie- of statistische analyse-tools kunnen verschijnen, die on-premise controles bieden waardoor het versturen van gegevens naar externe locaties wordt voorkomen.

Als uw product afhankelijk is van Claude of als u de detectie-API overweegt, controleer dan waar de tekst na de controle naartoe gaat en welke rechten u erover behoudt. Transparantie over door AI gegenereerde inhoud is waardevol, maar het mag niet ten koste gaan van het overhandigen van de privégegevens van uw gebruikers aan het bedrijf dat het watermerk zelf heeft gecreëerd.