Anthropic oficjalnie rozpoczęło wdrażanie znakowania wodnego tekstu w całej rodzinie modeli Claude, aby zwiększyć przejrzystość AI i dostosować się do nadchodzących regulacji. Choć firma obiecuje płynną integrację, narasta debata na temat wpływu na precyzję językową oraz prawnych konsekwencji wykrywalnego autorstwa AI.

Mechanika dyskretnego znakowania wodnego

Podejście Anthropic jest wzorowane na metodologii SynthID-Text od Google DeepMind. W przeciwieństwie do tradycyjnego znakowania wodnego, które może wprowadzać widoczne etykiety lub ukryte znaki Unicode, system ten działa na poziomie probabilistycznym Dużego Modelu Językowego (LLM). Działa on poprzez subtelne modyfikowanie źródła losowości używanego podczas wyboru tokenów. Poprzez dostosowanie prawdopodobieństwa konkretnych wyborów słów, system tworzy statystycznie wykrywalny wzorzec, który może zostać zidentyfikowany przez specjalistyczne oprogramowanie bez zmiany wizualnego wygl