Мирне врегулювання Anthropic щодо піратства на $1,5 млрд: рекордні збитки та стратегічна перемога

Anthropic досягла історичної згоди про виплату компенсації у розмірі 1,5 мільярда доларів групі авторів книг після звинувачень у використанні піратських баз даних для навчання своїх моделей. Хоча така величезна виплата є фінансовим ударом, юридичні нюанси справи можуть насправді стати значною перемогою для всієї індустрії ШІ щодо концепції «добросовісного використання» (fair use).

Деталі рекордного врегулювання

Федеральний суд у Сан-Франциско схвалив знакову угоду після того, як докази виявили, що Anthropic завантажувала книги з відомих піратських баз даних, зокрема LibGen та PiLiMi, у період між 2021 та 2022 роками. Масштаб врегулювання є безпрецедентним в історії колективних позовів, оскільки він охоплює приблизно 482 460 перелічених творів.

З загальної кількості залучених творів автори успішно заявили права на 91,3 відсотка. Кожен позивач отримає приблизно 3 000 доларів — суму, що в чотири рази перевищує встановлений законом мінімум. У межах юридичного врегулювання Anthropic зобов'язана знищити піратські файли, використані протягом цього періоду. Важливо, що угода не надає компанії повного імунітету; автори зберігають за собою право подавати позови, якщо результати роботи ШІ відтворюватимуть оригінальні твори або якщо майбутня практика збору даних Anthropic порушуватиме закони про авторське право.

Юридична деталь, що сприяє розвитку ШІ

Попри приголомшливу ціну у 1,5 мільярда доларів, юридичний прецедент, створений цією справою, є напрочуд сприятливим для лабораторій ШІ. Угода стосується конкретного акту використання піратських джерел, але вона не дає висновку щодо законності самого процесу навчання ШІ.

Суддя Алсуп раніше встановив критично важливе розмежування: навчання ШІ на юридично отриманих книгах є «трансформаційним — надзвичайно трансформаційним» — і цілком підпадає під доктрину добросовісного використання. Це розмежування є життєво важливим для таких компаній, як OpenAI, Google та Meta. Воно свідчить про те, що хоча джерело даних (піратство проти законного придбання) є зоною ризику, сам процес навчання моделі розумінню мови та закономірностей є юридично обґрунтованим.

Невирішена проблема масового веб-скрейпінгу

Хоча це рішення дає шанс лабораторіям, які навчалися на масивних наборах даних, юридична битва за «законне придбання» ще далеко не закінчена. Центральне питання залишається відкритим: чи є масовий веб-скрейпінг інтернет-контенту без чіткої згоди власників вебсайтів законним придбанням чи порушенням авторських прав?

Це врегулювання підкреслює двояку юридичну реальність для індустрії ШІ. Компанії можуть уникнути величезних штрафів, забезпечивши очищення своїх конвеєрів даних від відомих піратських репозиторіїв, проте вони все одно стикаються з невизначеністю щодо прав веб-видавців та творців контенту. Оскільки лабораторії ШІ продовжують масштабуватися, напруженість між трансформаційним технологічним прогресом та правами інтелектуальної власності залишатиметься найважливішим юридичним бар'єром для галузі.

Основні висновки

  • Рекордна виплата: Anthropic виплатить 1,5 мільярда доларів авторам після використання піратських баз даних, таких як LibGen, що стане найбільшим врегулюванням питань авторського права в історії колективних позовів.
  • Прецедент добросовісного використання: Суд підтвердив, що навчання ШІ на юридично отриманих даних є «надзвичайно трансформаційним», що створює потужний юридичний захист для легітимного навчання ШІ.
  • Цілісність даних має вирішальне значення: Рішення підкреслює, що законність навчання ШІ часто залежить від походження навчальних даних, а не від самого процесу навчання.