Un juez federal ha aprobado un acuerdo de 1.500 millones de dólares entre Anthropic y un grupo de autores, poniendo fin a un capítulo ruidoso y muy vigilado en la lucha sobre cómo las empresas de inteligencia artificial tratan los libros protegidos por derechos de autor. La jueza Araceli Martínez-Olguín ratificó el acuerdo, consolidando lo que los expertos legales califican como la mayor recuperación de derechos de autor conocida en la historia. El pago se deriva de una demanda colectiva de 2024 encabezada por escritores como Andrea Bartz, Charles Graeber y Kirk Wallace Johnson, quienes acusaron a la empresa de absorber millones de obras protegidas por derechos de autor para entrenar sus modelos de lenguaje de gran tamaño. Para una industria que durante mucho tiempo ha tratado la web abierta como un buffet libre, el mensaje es ahora inequívoco: esa era ha terminado.
La anatomía de un pago récord
Bajo el acuerdo aprobado, los autores recibirán aproximadamente 3.000 dólares por cada libro que Anthropic presuntamente pirateó. La demanda presentó un panorama desolador, comparando el comportamiento de la empresa con una "descarga al estilo Napster" a escala masiva. Una cosa es perder un cheque de regalías; otra muy distinta es enterarse de que un manuscrito completo fue ingerido por un modelo que ahora compite con los escritores humanos por la atención y el comercio.
La directora jurídica de Anthropic, Aparna Sridhar, ha indicado que la empresa quiere superar la disputa rápidamente. Señaló que más del 91 por ciento de los autores y editores elegibles ya han reclamado su parte de los fondos. Esa tasa de participación es importante. Las demandas colectivas suelen tener dificultades para llegar incluso a la mitad de las partes afectadas, por lo que la aceptación casi total sugiere que los pagos individuales fueron lo suficientemente grandes como para importar, o al menos lo suficientemente atractivos como para que los escritores no vieran ninguna ventaja en esperar un juicio por separado.
El titular de los 1.500 millones de dólares llama la atención, pero la cifra por libro cuenta una historia diferente. Para un autor de lista media con un único título incluido en un corpus de entrenamiento, 3.000 dólares podrían equivaler a varios años de regalías digitales. Para una franquicia de gran éxito, podría cubrir una semana de ventas. La variación en el impacto es precisamente la razón por la que la industria editorial está dividida sobre si este acuerdo es un modelo a seguir o un techo.
De una victoria parcial a un acuerdo de alto riesgo
El acuerdo no llegó de la nada. El juez jubilado William Alsup ya había otorgado a Anthropic una victoria parcial en procedimientos relacionados, sugiriendo que no todas las reclamaciones sobrevivirían a un escrutinio estricto. Sin embargo, la aprobación de este acuerdo de demanda colectiva establece un precedente crítico: la ingesta masiva de material protegido por derechos de autor sin compensación conlleva graves consecuencias financieras, y los desarrolladores ya no pueden asumir que se pueden recolectar conjuntos de datos masivos de la web abierta o de bibliotecas digitales sin riesgo legal.
¿Qué cambió? La escala y la claridad. Cuando un solo autor se queja de un fragmento, los tribunales pueden entrar en tecnicismos sobre el uso legítimo (fair use). Cuando se alega que se han copiado millones de libros en su totalidad para construir un producto comercial, la aritmética cambia. El acuerdo valida el argumento de que los datos de entrenamiento no son una externalidad que se pueda ignorar. Es un insumo con un precio, al igual que los clústeres de computación y las granjas de servidores.
Para los desarrolladores que aún entrenan modelos con archivos extraídos (scraped), el riesgo ya no es teórico. Es una partida presupuestaria.
El camino por delante: licencias, litigios y treguas inquietas
Anthropic no ha salido del todo del problema. Varias entidades, incluidos los editores de Chicken Soup for the Soul, están llevando a cabo sus propias demandas contra la empresa. Su argumento va directo al núcleo de la cifra de 3.000 dólares. Un pago fijo por libro, sostienen, ignora el valor de mercado a largo plazo de la propiedad intelectual y la forma en que los productos comerciales de IA monetizan el estilo, la estructura y la experiencia derivados de esas obras.
Estos casos de resistencia podrían resultar más costosos que el acuerdo colectivo. Si un jurado coincide en que una tarifa fija infravalora el uso comercial continuo de una propiedad, el modelo de daños podría pasar de un pago único a una estructura similar a las regalías o a una suma global mucho mayor vinculada a los ingresos del modelo. Esa posibilidad debería mantener despiertos a los equipos financieros de IA por la noche.
Deberíamos esperar una segunda ola de litigios. El acuerdo de Anthropic ofrece un modelo a los autores. Establece una cifra —$3.000 por libro— que los escritores y editores pueden citar en negociaciones o en los tribunales. Para los estudios más pequeños y los autores independientes que nunca se unieron a la demanda colectiva original, el acuerdo es una invitación a presentar una demanda. Para el panorama general de la IA, el coste de los datos de entrenamiento de alta calidad y legalmente conformes probablemente se convertirá en un gasto operativo principal, y no en una consideración secundaria.
Algunas empresas responderán suscribiendo acuerdos de licencia con editoriales, de forma similar a los acuerdos que las plataformas han buscado con organizaciones de medios. Otras podrían invertir fuertemente en la generación de datos sintéticos o bien optar por modelos entrenados únicamente con corpus que pertenezcan explícitamente al dominio público. Ninguno de estos
