Ugoda Anthropic w sprawie piractwa na kwotę 1,5 mld USD: Rekordowa strata i strategiczne zwycięstwo
Anthropic zawarło historyczną ugodę z grupą autorów książek na kwotę 1,5 miliarda dolarów w związku z zarzutami dotyczącymi wykorzystywania pirackich baz danych do trenowania swoich modeli. Choć ogromna wypłata jest ciosem finansowym, prawne niuanse tej sprawy mogą w rzeczywistości stanowić znaczące zwycięstwo dla całej branży AI w kontekście zasady dozwolonego użytku (fair use).
Szczegóły rekordowej ugody
Sąd federalny w San Francisco zatwierdził przełomową ugodę po tym, jak dowody wykazały, że Anthropic w latach 2021–2022 pobierało książki z niebezpiecznych pirackich baz danych, a konkretnie z LibGen i PiLiMi. Skala ugody jest bezprecedensowa w historii pozwów zbiorowych, obejmując około 482 460 wymienionych dzieł.
Z łącznej liczby zaangażowanych dzieł, 91,3 procent zostało skutecznie dochodzonych przez autorów. Każdy roszczący otrzyma około 3 000 USD, co stanowi kwotę czterokrotnie wyższą od ustawowego minimum. W ramach rozwiązania prawnego Anthropic jest zobowiązane do zniszczenia pirackich plików użytych w tym okresie. Co kluczowe, ugoda nie daje firmie pełnego przyzwolenia; autorzy zachowują prawo do wnoszenia roszczeń, jeśli wyniki działania AI będą reprodukować oryginalne dzieła lub jeśli przyszłe praktyki pozyskiwania danych przez Anthropic naruszą prawo autorskie.
Kwestia techniczna sprzyjająca rozwojowi AI
Mimo oszałamiającej kwoty 1,5 miliarda dolarów, precedens prawny ustanowiony przez tę sprawę jest zaskakująco korzystny dla laboratoriów AI. Ugoda odnosi się do konkretnego czynu, jakim jest korzystanie z pirackich źródeł, ale nie rozstrzyga o legalności samego procesu trenowania AI.
Sędzia Alsup ustalił wcześniej krytyczne rozróżnienie: trenowanie AI na legalnie pozyskanych książkach ma charakter „transformatywny – i to w spektakularnym stopniu” – i w pełni mieści się w doktrynie dozwolonego użytku (fair use). Rozróżnienie to jest kluczowe dla takich firm jak OpenAI, Google i Meta. Sugeruje ono, że choć źródło danych (piractwo vs. legalne pozyskanie) stanowi problem prawny, to sam proces trenowania modelu w celu zrozumienia języka i wzorców jest prawnie obronny.
Nierozwiązany problem masowego scrapingu
Choć to orzeczenie stanowi koło ratunkowe dla laboratoriów, które trenowały modele na ogromnych zbiorach danych, batalia prawna o „legalne pozyskiwanie” jest daleka od końca. Główne pytanie brzmi: czy masowy scraping treści internetowych bez wyraźnej zgody właścicieli stron internetowych stanowi legalne pozyskanie danych, czy naruszenie praw autorskich?
Ugoda ta uwypukla dwubiegunową rzeczywistość prawną dla branży AI. Firmy mogą uniknąć ogromnych kar, dbając o to, aby ich potoki danych (data pipelines) były oczyszczone z znanych pirackich repozytoriów, jednak wciąż mierzą się z niepewnością w kwestii praw wydawców internetowych i twórców treści. W miarę jak laboratoria AI będą się rozwijać, napięcie między transformatywnym postępem technologicznym a prawami własności intelektualnej pozostanie najważniejszą przeszkodą prawną w tej branży.
Kluczowe wnioski
- Rekordowa wypłata: Anthropic zapłaci autorom 1,5 miliarda dolarów za korzystanie z pirackich baz danych, takich jak LibGen, co stanowi największą ugodę dotyczącą praw autorskich w historii pozwów zbiorowych.
- Precedens dozwolonego użytku: Sąd potwierdził, że trenowanie AI na legalnie pozyskanych danych jest „spektakularnie transformatywne”, co zapewnia istotną ochronę prawną dla legalnego trenowania modeli AI.
- Integralność danych ma kluczowe znaczenie: Orzeczenie podkreśla, że legalność trenowania AI często zależy od pochodzenia danych treningowych, a nie od samego procesu trenowania.
