Anthropic wird in jeden Text und jede Datei, die von seinen Claude-Modellen erstellt wird, eine versteckte digitale Signatur einbetten – ein Schritt, der darauf abzielt, die neuen Transparenzregeln der Europäischen Union für KI zu erfüllen. Die Änderung tritt für alle Modelle in Kraft, die nach dem Inkrafttreten des Transparency Code des EU AI Acts am 2. August veröffentlicht wurden, und sie wird automatisch in den Schnittstellen Claude API, Code, Cowork und Tag erscheinen.
Warum die EU-Regel wichtig ist
Der Transparency Code verpflichtet Entwickler dazu, KI-generierte oder bearbeitete Inhalte zu kennzeichnen, damit nachgelagerte Systeme deren synthetischen Ursprung erkennen können. Die Regel zielt darauf ab, Desinformation einzudämmen und den Nutzern ein klares Signal zu geben, wenn sie es mit maschinell erstelltem Material zu tun haben. Anthropics Antwort – Wasserzeichen auf Modellebene – platziert die Kennzeichnung direkt im Output, anstatt sie lediglich in einer Produkt-Benutzeroberfläche (UI) hinzuzufügen.
Andere KI-Giganten geben ähnliche Versprechen ab. Google, Meta, Microsoft, OpenAI und Black Forest Labs haben alle erklärt, dass sie die EU-Standards erfüllen werden. Für nicht-textbasierte Assets wird Anthropic den offenen C2PA-Standard verwenden, eine öffentlich dokumentierte Methode zur Einbettung von Herkunftsnachweisen (Provenance Data) in Bilder, Videos und andere Medien. Durch die Einhaltung einer offenen Spezifikation hofft Anthropic, dass seine Kennzeichnungen mit Werkzeugen funktionieren, die Journalisten, Plattformen und Faktenchecker bereits nutzen.
Wie das Wasserzeichen funktioniert
Anthropic gibt an, dass das Wasserzeichen fest in den Textgenerierungsprozess des Modells integriert ist. In der Praxis wird die Signatur Teil des Token-Streams, den das Modell ausgibt. Wenn ein Nutzer den Text in ein Textverarbeitungsprogramm, eine E-Mail oder einen Social-Media-Post kopiert, wandert das versteckte Muster mit. Das Unternehmen merkt an, dass das Wasserzeichen moderate Bearbeitungen überstehen kann, hat jedoch nicht offengelegt, wie viele Zeichen sich ändern müssen, bevor die Markierung verschwindet.
Die „Claudefishing“-Besorgnis
Der Rollout von Anthropic erfolgt vor dem Hintergrund wachsender Besorgnis über den Missbrauch großer Sprachmodelle (LLMs). Substack-CEO Chris Best prägte kürzlich den Begriff „Claudefishing“, um den Einsatz von KI zur Erstellung täuschender Inhalte zu beschreiben, die die Stimme eines bestimmten Autors imitieren. Da synthetische Texte immer schwerer von menschlichen Texten zu unterscheiden sind, wird die automatisierte Erkennung der Herkunft zu einer entscheidenden Verteidigungslinie.
Anthropic ist nicht allein damit, Schutzmaßnahmen einzuführen. Die Musikgenerierungs-Plattform Suno und der Newsletter-Dienst Substack haben Kennzeichnungsmechanismen eingeführt, die Leser darauf hinweisen, wenn ein Stück KI-generiert wurde. Durch die Einbettung des Wasserzeichens an der Quelle zielt Anthropic darauf ab, das Signal schwerer entfernbar zu machen und es nachgelagerten Filtern zu erleichtern, darauf zu reagieren.
Wichtigste Erkenntnisse
- Einhaltung regulatorischer Vorschriften: Anthropic implementiert Wasserzeichen, um den Transparency Code des EU AI Acts zu erfüllen, der am 2. August in Kraft getreten ist.
- Integration auf Modellebene: Wasserzeichen werden auf Modellebene angewendet, sodass sie in allen Produkten (API, Claude Code usw.) bestehen bleiben und Copy-Paste-Vorgänge überstehen.
- Standardisierte Dateikennzeichnung: Für Dateien wird Anthropic den offenen C2PA-Standard verwenden, um Interoperabilität und Transparenz bei digitalen Inhalten zu gewährleisten.
