Anthropic впровадила водяний знак для тексту, створеного Claude, щоб відповідати вимогам Акту ЄС про ШІ (EU AI Act), згідно з якими синтетичний контент має бути чітко позначений у машинозчичуваному форматі. Компанія заявляє, що ця технологія маркує написаний ШІ текст, не уповільнюючи модель і не використовуючи додаткові токени — це твердження регулятори та конкуренти незабаром перевірять на практиці.

Чому водяний знак має значення

Водяний знак закладає у вибір слів приватний ключ та навколишній контекст. Читачі не можуть побачити цей патерн, але верифікатор, якому відомий ключ, може його виявити. На практиці інструмент подальшої обробки сканує документ і повідомляє, чи був він створений Claude.

Регуляторний тиск

Акт ЄС про ШІ (EU AI Act) зобов'язує постачальників генеративних систем вбудовувати детектовані сигнали в синтетичний контент.

Бізнес-компроміси

Компанії зважують три основні аспекти, вирішуючи, чи впроваджувати такі мітки:

  • Обмеження простежуваності – водяний знак підтверджує, що текст походить від моделі ШІ, але він не може пов'язати результат із конкретним користувачем або обліковим записом. Ця прогалина залишає питання відповідальності відкритим у випадках зловживання контентом, створеним ШІ.
  • Ризик для доходу – деякі постачальники побоюються, що видимі водяні знаки відлякають до третини їхніх клієнтів, які віддають перевагу немаркованому тексту з міркувань конкурентоспроможності або приватності.
  • Технічні обмеження – вбудовування патерну може дещо знизити креативність результатів моделі, особливо у дуже коротких фрагментах, де водяному знаку доступно менше слів. Користувачі також можуть послабити сигнал, вручну перефразуючи частини тексту, що ускладнює його виявлення.

Anthropic розраховує, що її підхід дозволить уникнути більшості цих недоліків. Завдяки вплетенню ключа в процес вибору токенів, компанія стверджує, що це не створює затримок і не потребує додаткових витрат на токени, зберігаючи рівень користувацького досвіду, на який очікують платні клієнти.

Технічні виклики

Можливість виявлення залежить від того, чи має верифікатор той самий приватний ключ, що використовувався під час генерації. Короткі тексти залишаються слабким місцем, оскільки статистичний патерн у них менш виражений, що підвищує рівень хибнонегативних результатів. Водяний знак також не запобігає подальшому редагуванню: користувач, який перепише половину абзацу, може фактично стерти мітку.

Підсумок: Водяний знак Anthropic відповідає новому законодавчому мандату, але його ефективність залежатиме від того, наскільки вдало він балансуватиме між здатністю до виявлення, обмеженням гнучкості та ризиком обходу системи.