Anthropic logra un acuerdo de 1.500 millones de dólares en un histórico litigio de derechos de autor de IA

Un juez federal ha aprobado oficialmente el masivo acuerdo de 1.500 millones de dólares de Anthropic con autores y editoriales, marcando un momento histórico en la batalla legal sobre los datos de entrenamiento de la IA. Si bien el pago es el más grande en la historia de los derechos de autor en EE. UU., el fallo legal subyacente crea un panorama complejo para el futuro del desarrollo de la IA generativa.

El desglose financiero y el problema de la piratería

El acuerdo surge tras una demanda colectiva centrada en cómo Anthropic adquirió los datos utilizados para entrenar sus modelos de lenguaje de gran tamaño. El tribunal determinó que, si bien Anthropic compró algunos libros, también descargó ilegalmente millones de obras protegidas por derechos de autor de sitios piratas como Library Genesis y Pirate Library Mirror.

Para resolver el litigio y evitar un juicio por jurado potencialmente más perjudicial, Anthropic aceptó un pago de 3.000 dólares por obra en un total estimado de 500.000 obras. Estos fondos se distribuirán entre los autores y editoriales que poseen los derechos del material infringido. La jueza Araceli Martinez-Olguin firmó la aprobación final, concluyendo un proceso que comenzó bajo el mando del juez anterior, William Alsup.

Una victoria controvertida para el "uso legítimo" (Fair Use)

A pesar de la enorme penalización económica, la victoria legal pertenece en gran medida a Anthropic en lo que respecta al principio fundamental del entrenamiento de la IA. En una decisión que ha causado conmoción en la industria tecnológica, el juez Alsup dictaminó que entrenar un modelo de IA con texto protegido por derechos de autor constituye "uso legítimo" (fair use).

Esta distinción es crítica: el tribunal no penalizó a Anthropic por el acto de aprender del texto, sino por el método de adquisición, específicamente el uso de repositorios piratas. Al separar la legalidad del entrenamiento de modelos de la legalidad de la obtención de datos, el tribunal ha proporcionado un escudo legal significativo para los laboratorios de IA, siempre que puedan demostrar que sus conjuntos de entrenamiento se adquieren a través de canales legítimos.

Aunque este caso cierra el capítulo para Anthropic, no establece un precedente nacional vinculante. Debido a que Anthropic optó por llegar a un acuerdo, el caso nunca llegará a un tribunal de apelaciones para establecer una regla definitiva para toda la industria. En consecuencia, la cuestión del "uso legítimo" sigue siendo un campo de batalla abierto para otros actores importantes.

El panorama de la IA se enfrenta actualmente a una ola de litigios similares. Empresas como Google, Meta, Midjourney y OpenAI están lidiando con demandas activas sobre sus metodologías de entrenamiento. Por ejemplo, una reciente demanda colectiva que involucra a pesos pesados como Hachette, Cengage y Elsevier acusa a Google de utilizar obras protegidas por derechos de autor para entrenar su plataforma Gemini. Hasta que un tribunal superior emita un fallo definitivo, la situación legal del entrenamiento de IA seguirá siendo un mosaico de decisiones a nivel de distrito.

Conclusiones clave

  • Pago histórico: Anthropic pagará 1.500 millones de dólares para resolver las reclamaciones, distribuyendo 3.000 dólares por obra en aproximadamente 500.000 obras protegidas por derechos de autor.
  • Precedente de uso legítimo: El tribunal dictaminó que el entrenamiento de modelos de IA con texto protegido por derechos de autor constituye "uso legítimo", aunque el uso específico de fuentes piratas se consideró ilegal.
  • Persiste la incertidumbre legal: Debido a que se trató de un acuerdo y no de un fallo de apelación, la legalidad del entrenamiento de IA sigue sin resolverse para empresas como OpenAI, Google y Meta.