Мировое соглашение Anthropic по делу о пиратстве на 1,5 млрд долларов: рекордные убытки и стратегическая победа

Компания Anthropic достигла исторического мирового соглашения на сумму 1,5 миллиарда долларов с группой авторов книг после обвинений в использовании пиратских баз данных для обучения своих моделей. Хотя столь масштабная выплата является финансовым ударом, юридические нюансы дела могут на самом деле стать значительной победой для всей индустрии ИИ в вопросе добросовестного использования (fair use).

Детали рекордного мирового соглашения

Федеральный суд в Сан-Франциско утвердил знаковое мировое соглашение после того, как были представлены доказательства того, что в период с 2021 по 2022 год Anthropic скачивала книги из печально известных пиратских баз данных, в частности LibGen и PiLiMi. Масштаб соглашения является беспрецедентным в истории коллективных исков, охватывая примерно 482 460 перечисленных произведений.

Из общего числа задействованных произведений авторы успешно заявили права на 91,3%. Каждый заявитель получит примерно 3 000 долларов США — сумму, которая в четыре раза превышает установленный законом минимум. В рамках юридического урегулирования Anthropic обязана уничтожить пиратские файлы, использованные в этот период. Что крайне важно, мировое соглашение не дает компании карт-бланш: авторы сохраняют за собой право предъявлять претензии, если результаты работы ИИ воспроизводят оригинальные произведения или если будущие методы сбора данных Anthropic будут нарушать законы об авторском праве.

Юридическая тонкость, играющая на руку развитию ИИ

Несмотря на ошеломляющую цену в 1,5 миллиарда долларов, юридический прецедент, созданный этим делом, на удивление благоприятен для лабораторий ИИ. Соглашение касается конкретного акта использования пиратских источников, но не выносит решения о законности самого процесса обучения ИИ.

Судья Алсуп ранее провел критически важное различие: обучение ИИ на законно полученных книгах является «трансформационным — в исключительной степени» и полностью подпадает под доктрину добросовестного использования (fair use). Это различие жизненно важно для таких компаний, как OpenAI, Google и Meta. Оно предполагает, что, хотя источник данных (пиратство против законного приобретения) является фактором ответственности, сам процесс обучения модели пониманию языка и закономерностей юридически обоснован.

Неразрешенная проблема массового скрейпинга

Хотя это решение дает передышку лабораториям, обучавшимся на массивных наборах данных, юридическая битва за «законное приобретение» еще далека от завершения. Центральный вопрос остается открытым: является ли массовый скрейпинг интернет-контента без явного согласия владельцев веб-сайтов законным приобретением или нарушением авторских прав?

Это соглашение подчеркивает раздвоенную юридическую реальность для индустрии ИИ. Компании могут избежать огромных штрафов, обеспечив очистку своих конвейеров данных от известных пиратских репозиториев, но они по-прежнему сталкиваются с неопределенностью в отношении прав веб-издателей и создателей контента. По мере масштабирования лабораторий ИИ напряженность между трансформационным технологическим прогрессом и правами интеллектуальной собственности будет оставаться самым серьезным юридическим препятствием для отрасли.

Основные выводы

  • Рекордная выплата: Anthropic выплатит авторам 1,5 миллиарда долларов за использование пиратских баз данных, таких как LibGen, что станет крупнейшим мировым соглашением по вопросам авторского права в истории коллективных исков.
  • Прецедент добросовестного использования: Суд подтвердил, что обучение ИИ на законно полученных данных является «исключительно трансформационным», что создает мощный юридический щит для легитимного обучения ИИ.
  • Целостность данных имеет решающее значение: Решение подчеркивает, что законность обучения ИИ часто зависит от происхождения обучающих данных, а не от самого процесса обучения.