Anthropic wprowadziło znak wodny dla tekstów generowanych przez Claude, aby spełnić wymogi unijnego aktu o sztucznej inteligencji (EU AI Act), zgodnie z którymi treści syntetyczne muszą być wyraźnie oznaczone w sposób czytelny dla maszyn. Firma twierdzi, że technika ta pozwala oznaczać teksty napisane przez AI bez spowalniania modelu i bez zużywania dodatkowych tokenów – jest to twierdzenie, które wkrótce poddadzą testom regulatorzy i konkurenci.

Dlaczego znak wodny jest ważny

Znak wodny „zasiewa” decyzje dotyczące doboru słów za pomocą klucza prywatnego i otaczającego kontekstu. Czytelnicy nie widzą tego wzorca, ale weryfikator posiadający klucz może go wykryć. W praktyce narzędzie zewnętrzne skanuje dokument i raportuje, czy został on wygenerowany przez Claude.

Presja regulacyjna

EU AI Act zmusza dostawców systemów generatywnych do umieszczania wykrywalnych sygnałów w treściach syntetycznych.

Biznesowe kompromisy

Firmy muszą mierzyć się z trzema kwestiami, decydując o wdrożeniu takich oznaczeń:

  • Ograniczenia identyfikowalności – Znak wodny potwierdza, że tekst pochodzi z modelu AI, ale nie pozwala powiązać wyniku z konkretnym użytkownikiem lub kontem. Ta luka sprawia, że kwestia odpowiedzialności pozostaje otwarta w przypadku niewłaściwego wykorzystania treści wygenerowanych przez AI.
  • Ryzyko utraty przychodów – Niektórzy dostawcy obawiają się, że widoczne znaki wodne mogą odstraszyć nawet jedną trzecią ich klientów, którzy ze względów konkurencyjnych lub prywatności wolą nieoznaczone teksty.
  • Ograniczenia techniczne – Umieszczenie wzorca może nieco ograniczyć kreatywność wyników modelu, szczególnie w bardzo krótkich fragmentach, gdzie znak wodny ma do dyspozycji mniej słów. Użytkownicy mogą również osłabić sygnał poprzez ręczne parafrazowanie części tekstu, co utrudnia wykrycie.

Anthropic liczy na to, że jego podejście pozwoli uniknąć większości tych wad. Dzięki wpleceniu klucza w proces wyboru tokenów, firma twierdzi, że nie występuje opóźnienie ani dodatkowy koszt tokenów, co pozwala zachować doświadczenie użytkownika, jakiego oczekują płacący klienci.

Wyzwania techniczne

Wykrywalność zależy od tego, czy weryfikator posiada ten sam klucz prywatny, który został użyty podczas generowania. Krótkie teksty pozostają słabym punktem, ponieważ wzorzec statystyczny jest w nich mniej wyraźny, co zwiększa liczbę wyników fałszywie ujemnych. Znak wodny nie zapobiega również późniejszej edycji; użytkownik, który przepisze połowę akapitu, może skutecznie usunąć oznaczenie.

Podsumowanie: Znak wodny Anthropic odpowiada na nowe wymogi prawne, ale jego skuteczność będzie zależeć od tego, jak dobrze uda się zrównoważyć wykrywalność z ograniczoną elastycznością i ryzykiem obejścia zabezpieczeń.