Un giudice federale ha approvato un accordo da 1,5 miliardi di dollari tra Anthropic e una classe di autori, ponendo fine a un capitolo rumoroso e seguito con attenzione nella battaglia su come le aziende di intelligenza artificiale trattano i libri protetti da copyright. La giudice Araceli Martínez-Olguín ha approvato l'accordo, consolidando quello che gli esperti legali definiscono il più grande recupero di copyright noto nella storia. Il risarcimento deriva da una class action del 2024 guidata da scrittori tra cui Andrea Bartz, Charles Graeber e Kirk Wallace Johnson, che hanno accusato l'azienda di aver "aspirato" milioni di opere protette da copyright per addestrare i propri modelli linguistici di grandi dimensioni. Per un settore che per lungo tempo ha trattato il web aperto come un buffet gratuito, il messaggio è ormai inequivocabile: quell'era è finita.
L'anatomia di un risarcimento record
In base all'accordo approvato, gli autori riceveranno circa 3.000 dollari per ogni libro che Anthropic avrebbe piratato. L'atto di citazione ha delineato un quadro crudo, paragonando il comportamento dell'azienda a un "download in stile Napster" su scala massiccia. Una cosa è perdere un assegno di royalty; un'altra è scoprire che un intero manoscritto è stato inglobato in un modello che ora compete con gli scrittori umani per attenzione e commercio.
L'ufficio legale di Anthropic, rappresentato da Aparna Sridhar, ha indicato che l'azienda vuole superare rapidamente la controversia. Ha osservato che oltre il 91 percento degli autori e degli editori aventi diritto ha già richiesto la propria quota di fondi. Quel tasso di partecipazione è importante. Le class action spesso faticano a raggiungere anche solo la metà delle parti interessate, quindi il coinvolgimento quasi totale suggerisce che i risarcimenti individuali fossero abbastanza consistenti da contare, o almeno abbastanza convincenti da far ritenere agli scrittori che non ci fosse alcun vantaggio nell'attendere un processo separato.
Il titolo da 1,5 miliardi di dollari attira l'attenzione, ma la cifra per singolo libro racconta una storia diversa. Per un autore di media fama con un singolo titolo incluso in un corpus di addestramento, 3.000 dollari potrebbero equivalere a diversi anni di royalty digitali. Per un franchise di bestseller, potrebbero coprire una settimana di vendite. La variazione dell'impatto è esattamente il motivo per cui l'industria editoriale è divisa sul fatto che questo accordo sia un modello da seguire o un limite massimo.
Da una vittoria parziale a un accordo ad alto rischio
L'accordo non è arrivato dal nulla. Il giudice in pensione William Alsup aveva precedentemente concesso ad Anthropic una vittoria parziale in procedimenti correlati, suggerendo che non tutte le rivendicazioni avrebbero superato un esame rigoroso. Eppure, l'approvazione di questo accordo per la class action stabilisce un precedente critico: l'ingestione massiccia di materiale protetto da copyright senza compenso comporta gravi conseguenze finanziarie, e gli sviluppatori non possono più dare per scontato che enormi dataset possano essere raccolti dal web aperto o dalle biblioteche digitali senza rischi legali.
Cosa è cambiato? La scala e la chiarezza. Quando un singolo autore si lamenta di un frammento, i tribunali possono perdersi in tecnicismi sul "fair use". Quando milioni di libri vengono presuntamente copiati integralmente per costruire un prodotto commerciale, l'aritmetica cambia. L'accordo convalida l'argomento secondo cui i dati di addestramento non sono un'esternalità da ignorare. È un input con un prezzo, proprio come i cluster di calcolo e le server farm.
Per gli sviluppatori che addestrano ancora modelli su archivi estratti tramite scraping, il rischio non è più teorico. È una voce di bilancio.
La strada da percorrere: licenze, contenziosi e tregue precarie
Anthropic non è ancora fuori dai guai. Diverse entità, inclusi gli editori dietro Chicken Soup for the Soul, stanno portando avanti le proprie cause legali contro l'azienda. La loro argomentazione va al cuore della cifra di 3.000 dollari. Un pagamento fisso per libro, sostengono, ignora il valore di mercato a lungo termine della proprietà intellettuale e il modo in cui i prodotti commerciali di IA monetizzano lo stile, la struttura e l'esperienza derivati da quelle opere.
Questi casi di resistenza potrebbero rivelarsi più costosi dell'accordo della class action. Se una giuria dovesse concordare sul fatto che una quota fissa sminuisca l'uso commerciale continuo di una proprietà, il modello dei danni potrebbe passare da un risarcimento una tantum a una struttura simile alle royalty o a una somma forfettaria molto più grande legata ai ricavi del modello. Questa possibilità dovrebbe togliere il sonno a ogni team finanziario del settore IA.
Dovremmo aspettarci una seconda ondata di contenziosi legali. L'accordo con Anthropic fornisce agli autori un modello. Stabilisce una cifra — 3.000 dollari per libro — che scrittori ed editori possono citare nelle negoziazioni o in tribunale. Per i piccoli studi e gli autori indipendenti che non hanno mai aderito alla class action originale, la transazione è un invito a intentare nuove cause. Per il più ampio panorama dell'IA, il costo di dati di addestramento di alta qualità e legalmente conformi diventerà probabilmente una spesa operativa primaria, e non un elemento da considerare in un secondo momento.
Alcune aziende risponderanno stipulando accordi di licenza con gli editori, in modo simile agli accordi che le piattaforme hanno perseguito con le organizzazioni mediatiche. Altre potrebbero investire pesantemente nella generazione di dati sintetici o optare per modelli addestrati esclusivamente su corpora esplicitamente di pubblico dominio. Nessuno di questi
