Anthropic hat eine bedeutende Wende bei der KI-Transparenz angekündigt, indem das Unternehmen sich dazu verpflichtet hat, alle Ausgaben der Claude-Modelle weltweit mit Wasserzeichen zu versehen. Dieser Schritt, der durch den EU AI Act Code of Practice vorangetrieben wird, zielt darauf ab, einen klaren Herkunftsnachweis für KI-generierte Texte und Dateien über das gesamte Produktökosystem hinweg zu gewährleisten.

Ein globaler Standard für Herkunftsnachweis und Transparenz

Obwohl das Mandat aus dem EU AI Act stammt, beschränkt Anthropic diesen Schutz nicht nur auf europäische Nutzer. Ab August 2026 werden alle neuen Claude-Modelle über eine integrierte Kennzeichnung verfügen. Dieser Rollout wird die gesamte Claude-Suite umfassen, einschließlich der Claude API, Claude Code, Claude Cowork und Claude Tag.

Die Strategie umfasst einen zweistufigen Identifizierungsansatz. Für Texte wird Anthropic ein unsichtbares Wasserzeichen implementieren, das auf Modellebene angewendet wird. Dieses Wasserzeichen ist so konzipiert, dass es nicht störend wirkt und sicherstellt, dass Bedeutung, Qualität und Lesbarkeit der Prosa unberührt bleiben. Entscheidend ist, dass Anthropic behauptet, dass diese Markierungen auch dann bestehen bleiben können, wenn der Text kopiert, eingefügt oder geringfügigen Bearbeitungen unterzogen wurde.

Für visuelle und strukturierte Daten wird Anthropic den offenen C2PA-Standard (Coalition for Content Provenance and Authenticity) nutzen. Unterstützte Dateiformate wie .svg, .png und .jpg werden digital signierte Provenance-Metadaten tragen. Diese Signatur dient als nachweisbare Aufzeichnung darüber, dass Claude die Datei verarbeitet hat, und kann helfen, nachträgliche Manipulationen zu erkennen.

Technische Herausforderungen und Erkennungsgrenzen

Trotz des robusten technischen Rahmens vertritt Anthropic eine realistische Haltung gegenüber den Grenzen der Wasserzeichen-Technologie. Ein erkanntes Wasserzeichen beweist nicht zwangsläufig, dass Claude den Inhalt verfasst hat; Nutzer verwenden Claude häufig für sekundäre Aufgaben wie Übersetzen, Zusammenfassen oder Korrekturlesen, was ein Wasserzeichen bei ursprünglich von Menschen stammenden Ideen auslösen könnte.

Umgekehrt ist das Fehlen eines Wasserzeichens keine Garantie für eine menschliche Urheberschaft. Mehrere Faktoren können diese Signale entfernen oder verschleiern, darunter:

  • Starke manuelle Bearbeitung oder umfangreiches erneutes Übersetzen.
  • Textpassagen, die für eine zuverlässige statistische Erkennung zu kurz sind.
  • Entfernen von Metadaten während der Formatkonvertierung oder durch Screenshots.

Dies schafft eine komplexe Landschaft für Entwickler. Wer Claude in Dienste von Drittanbietern integriert, muss sorgfältig prüfen, welche Anforderungen von Artikel 50 des EU AI Act für seine spezifische Implementierung gelten.

Die breitere KI-Landschaft: Wettbewerb und Ethik

Der Schritt von Anthropic versetzt das Unternehmen in direkten Wettbewerb mit anderen Branchenriesen in Bezug auf Sicherheit und Transparenz. Google DeepMind hat bereits sein SynthID-System in Gemini-Modelle integriert, das die Wahrscheinlichkeiten der Token-Vorhersage anpasst, um Wasserzeichen einzubetten. Unterdessen hat OpenAI bekanntermaßen die Veröffentlichung seines eigenen hochpräzisen Textdetektors verzögert und dabei Bedenken hinsichtlich falsch-positiver Ergebnisse sowie der Leichtigkeit angeführt, mit der Nutzer solche Tools durch Umschreiben umgehen können.

Besonders hoch stehen die Einsätze im Bildungssektor. Da Institutionen mit KI-gestütztem Plagiat und „KI-gesteuerten“ Betrugsmaschen im Zusammenhang mit Finanzhilgebetrug zu kämpfen haben, ist der Bedarf an zuverlässiger Erkennung dringend. Die Branche muss dieses Bedürfnis jedoch gegen das Risiko falscher Anschuldigungen abwägen. Durch die Bereitstellung von Verifizierungswerkzeugen für Dritte versucht Anthropic, die Branche in Richtung einer standardisierten, nachweisbaren Methode der Inhaltsauthentifizierung zu bewegen.

Wichtigste Erkenntnisse

  • Globale Implementierung: Die Wasserzeichen von Anthropic werden für alle Claude-Produkte weltweit gelten, einschließlich der API, und nicht nur innerhalb der EU.
  • Zweistufiger Ansatz: Das Unternehmen wird unsichtbare Text-Wasserzeichen und nach dem C2PA-Standard signierte Metadaten für Bilddateien (.png, .jpg, .svg) verwenden.
  • Beständigkeit vs. Zuverlässigkeit: Obwohl Wasserzeichen so konzipiert sind, dass sie Kopien und geringfügige Bearbeitungen überstehen, sind sie nicht unfehlbar und können durch umfangreiches Umformatieren oder Übersetzen umgangen werden.