Anthropic ottiene un accordo da 1,5 miliardi di dollari in una storica causa sul copyright dell'IA

Un giudice federale ha approvato ufficialmente il massiccio accordo da 1,5 miliardi di dollari di Anthropic con autori ed editori, segnando un momento storico nella battaglia legale sui dati di addestramento dell'IA. Sebbene il risarcimento sia il più ingente nella storia del copyright statunitense, la decisione legale sottostante crea un panorama complesso per il futuro dello sviluppo dell'IA generativa.

Dettagli finanziari e il problema della pirateria

L'accordo segue una class-action incentrata su come Anthropic abbia acquisito i dati utilizzati per addestrare i suoi grandi modelli linguistici. La corte ha accertato che, sebbene Anthropic avesse acquistato alcuni libri, aveva anche scaricato illegalmente milioni di opere protette da copyright da siti pirata come Library Genesis e Pirate Library Mirror.

Per risolvere il contenzioso ed evitare un processo con giuria potenzialmente più dannoso, Anthropic ha accettato un risarcimento di 3.000 dollari per opera su una stima di 500.000 opere. Questi fondi saranno distribuiti tra gli autori e gli editori che detengono i diritti del materiale violato. La giudice Araceli Martinez-Olguin ha apposto la firma sull'approvazione finale, concludendo un processo iniziato sotto il precedente giudice, William Alsup.

Una controversa vittoria per il "fair use"

Nonostante la massiccia sanzione finanziaria, la vittoria legale appartiene in gran parte ad Anthropic per quanto riguarda il principio fondamentale dell'addestramento dell'IA. In una decisione che ha sconvolto l'industria tecnologica, il giudice Alsup ha stabilito che l'addestramento di un modello di IA su testi protetti da copyright costituisce "fair use".

Questa distinzione è fondamentale: la corte non ha penalizzato Anthropic per l'atto di apprendere dal testo, bensì per il metodo di acquisizione — nello specifico, l'uso di repository piratati. Separando la legalità dell'addestramento del modello dalla legalità dell'approvvigionamento dei dati, la corte ha fornito uno scudo legale significativo per i laboratori di IA, a condizione che possano dimostrare che i loro set di addestramento siano acquisiti attraverso canali legittimi.

Perché questo non mette fine alla guerra legale sull'IA

Sebbene questo caso chiuda il capitolo per Anthropic, non stabilisce un precedente nazionale vincolante. Poiché Anthropic ha scelto di raggiungere un accordo, il caso non raggiungerà mai una corte d'appello per stabilire una regola definitiva per l'intero settore. Di conseguenza, la questione del "fair use" rimane un campo di battaglia aperto per altri grandi attori.

Il panorama dell'IA sta attualmente affrontando un'ondata di contenziosi simili. Aziende tra cui Google, Meta, Midjourney e OpenAI stanno tutte affrontando cause legali attive riguardanti le loro metodologie di addestramento. Ad esempio, una recente class-action che coinvolge colossi come Hachette, Cengage ed Elsevier accusa Google di utilizzare opere protette da copyright per addestrare la sua piattaforma Gemini. Finché una corte superiore non emetterà una sentenza definitiva, lo status legale dell'addestramento dell'IA rimarrà un mosaico di decisioni a livello distrettuale.

Punti chiave

  • Risarcimento storico: Anthropic pagherà 1,5 miliardi di dollari per chiudere le controversie, distribuendo 3.000 dollari per opera su circa 500.000 opere protette da copyright.
  • Precedente sul Fair Use: La corte ha stabilito che l'addestramento di modelli di IA su testi protetti da copyright costituisce "fair use", sebbene l'uso specifico di fonti piratate sia stato ritenuto illegale.
  • L'incertezza legale persiste: Poiché si è trattato di un accordo transattivo e non di una sentenza d'appello, la legalità dell'addestramento dell'IA rimane irrisolta per aziende come OpenAI, Google e Meta.