Anthropic оголосила про масштабні зміни в прозорості ШІ, зобов'язавшись впроваджувати водяні знаки на всі результати роботи моделей Claude в усьому світі. Цей крок, зумовлений Кодексом практики Закону ЄС про ШІ (EU AI Act Code of Practice), має на меті забезпечити чітке походження ШІ-генерованого тексту та файлів у всій екосистемі продуктів компанії.

Глобальний стандарт походження та прозорості

Хоча це розпорядження випливає із Закону ЄС про ШІ, Anthropic не обмежує ці заходи захисту лише європейськими користувачами. Починаючи з серпня 2026 року, усі нові моделі Claude матимуть вбудоване маркування. Це розгортання охопить увесь набір продуктів Claude, включаючи Claude API, Claude Code, Claude Cowork та Claude Tag.

Стратегія передбачає двошаровий підхід до ідентифікації. Для тексту Anthropic впровадить невидимий водяний знак, що застосовується на рівні моделі. Цей водяний знак розроблений так, щоб бути ненав'язливим, гарантуючи, що зміст, якість і читабельність тексту залишаться незмінними. Важливо, що Anthropic стверджує: ці мітки можуть зберігатися навіть після того, як текст було скопійовано, вставлено або піддано незначному редагуванню.

Для візуальних та структурованих даних Anthropic використовуватиме відкритий стандарт C2PA (Coalition for Content Provenance and Authenticity). Підтримувані формати файлів, такі як .svg, .png та .jpg, матимуть цифровий підпис метаданих походження. Цей підпис слугує верифікованим записом того, що Claude обробив файл, і може допомогти виявити подальші маніпуляції з ним.

Технічні виклики та межі виявлення

Попри надійну технічну базу, Anthropic дотримується реалістичного ставлення до обмежень водяних знаків. Виявлений водяний знак сам по собі не доводить, що контент був створений Claude; користувачі часто використовують Claude для допоміжних завдань, таких як переклад, резюмування або коректура, що може призвести до появи водяного знака на ідеях, створених людиною.

І навпаки, відсутність водяного знака не є гарантією авторства людини. Кілька факторів можуть видалити або приховати ці сигнали, зокрема:

  • Ретельне ручне редагування або глибокий переклад.
  • Текстові фрагменти, які занадто короткі для надійного статистичного виявлення.
  • Видалення метаданих під час конвертації форматів або через скриншоти.

Це створює складні умови для розробників. Ті, хто інтегрує Claude у сторонні сервіси, повинні ретельно оцінити, які саме вимоги Статті 50 Закону ЄС про ШІ застосовуються до їхньої конкретної реалізації.

Ширший ландшафт ШІ: конкуренція та етика

Крок Anthropic ставить компанію у пряму конкуренцію з іншими гігантами галузі в питаннях безпеки та прозорості. Google DeepMind уже інтегрував свою систему SynthID у моделі Gemini, яка змінює ймовірності передбачення токенів для впровадження водяних знаків. Тим часом OpenAI відома тим, що відклала випуск власного високоточного детектора тексту, посилаючись на занепокоєння щодо хибнопозитивних результатів і того, наскільки легко користувачі можуть обійти такі інструменти шляхом перефразування.

Ставки особливо високі в секторі освіти. Оскільки навчальні заклади борються з плагіатом за допомогою ШІ та «керованим ШІ» шахрайством, пов'язаним із махінаціями з фінансовою допомогою, потреба в надійному виявленні є нагальною. Однак галузь має збалансувати цю потребу з ризиком неправомірних звинувачень. Випускаючи інструменти верифікації для третіх сторін, Anthropic намагається підштовхнути галузь до стандартизованого, верифікованого методу автентифікації контенту.

Основні висновки

  • Глобальне впровадження: Водяні знаки Anthropic застосовуватимуться до всіх продуктів Claude в усьому світі, включаючи API, а не лише в межах ЄС.
  • Двометодний підхід: Компанія використовуватиме невидимі водяні знаки для тексту та підписані метадані за стандартом C2PA для файлів зображень (.png, .jpg, .svg).
  • Стійкість проти надійності: Хоча водяні знаки розроблені так, щоб витримувати копіювання та незначне редагування, вони не є бездоганними та можуть бути обійдені шляхом глибокого реформатування або перекладу.