Anthropic hat ein Wasserzeichen für von Claude generierte Texte eingeführt, um die Anforderungen des EU AI Acts zu erfüllen, wonach synthetische Inhalte eindeutig in maschinenlesbarer Form gekennzeichnet werden müssen. Das Unternehmen gibt an, dass die Technik KI-geschriebene Texte markiert, ohne das Modell zu verlangsamen oder zusätzliche Token zu verbrauchen – eine Behauptung, die Regulierungsbehörden und Wettbewerber bald prüfen werden.

Warum das Wasserzeichen wichtig ist

Das Wasserzeichen verknüpft die Wortwahl mit einem privaten Schlüssel und dem umgebenden Kontext. Leser können das Muster nicht erkennen, aber ein Verifizierer, der den Schlüssel kennt, kann es aufspüren. In der Praxis scannt ein nachgelagertes Tool ein Dokument und meldet, ob Claude es erstellt hat.

Regulatorischer Druck

Der EU AI Act zwingt Anbieter generativer Systeme dazu, erkennbare Signale in synthetische Inhalte einzubetten.

Wirtschaftliche Abwägungen

Unternehmen müssen drei Aspekte abwägen, wenn sie entscheiden, ob sie solche Kennzeichnungen einführen:

  • Einschränkungen der Rückverfolgbarkeit – Das Wasserzeichen bestätigt, dass der Text von einem KI-Modell stammt, kann die Ausgabe jedoch nicht einem bestimmten Nutzer oder Konto zuordnen. Diese Lücke lässt die Verantwortlichkeit offen, wenn KI-generierte Inhalte missbraucht werden.
  • Umsatzrisiko – Einige Anbieter befürchten, dass sichtbare Wasserzeichen bis zu einem Drittel ihrer Kundschaft abschrecken könnten, die aus Wettbewerbs- oder Datenschutzgründen unmarkierte Texte bevorzugt.
  • Technische Einschränkungen – Das Einbetten eines Musters kann die Kreativität der Modellausgabe etwas einschränken, insbesondere bei sehr kurzen Textfragmenten, bei denen das Wasserzeichen weniger Wörter zur Verfügung hat. Nutzer können das Signal zudem abschwächen, indem sie Teile des Textes manuell umformulieren, was die Erkennung erschwert.

Anthropic setzt darauf, dass sein Ansatz die meisten dieser Nachteile umgeht. Durch das Einweben des Schlüssels in den Token-Auswahlprozess behauptet das Unternehmen, dass es weder Latenzverluste noch zusätzliche Token-Kosten gibt, wodurch das Nutzererlebnis gewahrt bleibt, das zahlende Kunden erwarten.

Technische Herausforderungen

Die Erkennbarkeit hängt davon ab, dass der Verifizierer über denselben privaten Schlüssel verfügt, der während der Generierung verwendet wurde. Kurze Texte bleiben eine Schwachstelle, da das statistische Muster weniger ausgeprägt ist, was die Rate der falsch-negativen Ergebnisse erhöht. Das Wasserzeichen verhindert auch keine nachgelagerten Bearbeitungen; ein Nutzer, der die Hälfte des Absatzes umschreibt, kann die Markierung effektiv löschen.

Fazit: Das Wasserzeichen von Anthropic beantwortet eine neue gesetzliche Vorgabe, aber seine Wirkung wird davon abhängen, wie gut es die Erkennbarkeit mit der verringerten Flexibilität und dem Risiko der Umgehung in Einklang bringt.