Anthropic obtient un accord de 1,5 milliard de dollars dans un procès historique sur le droit d'auteur de l'IA
Un juge fédéral a officiellement approuvé l'accord massif de 1,5 milliard de dollars conclu par Anthropic avec des auteurs et des éditeurs, marquant un moment historique dans la bataille juridique sur les données d'entraînement de l'IA. Bien que le versement soit le plus important de l'histoire du droit d'auteur aux États-Unis, la décision juridique sous-jacente crée un paysage complexe pour l'avenir du développement de l'IA générative.
Détails financiers et problème de piratage
L'accord fait suite à un recours collectif portant sur la manière dont Anthropic a acquis les données utilisées pour entraîner ses grands modèles de langage. Le tribunal a conclu que, bien qu'Anthropic ait acheté certains livres, l'entreprise a également téléchargé illégalement des millions d'œuvres protégées par le droit d'auteur à partir de sites pirates tels que Library Genesis et Pirate Library Mirror.
Pour résoudre le litige et éviter un procès devant jury potentiellement plus préjudiciable, Anthropic a accepté de verser 3 000 $ par œuvre sur un total estimé à 500 000 œuvres. Ces fonds seront répartis entre les auteurs et les éditeurs qui détiennent les droits sur le matériel enfreint. La juge Araceli Martinez-Olguin a signé l'approbation finale, concluant un processus qui avait débuté sous la direction de l'ancien juge William Alsup.
Une victoire controversée pour l'« usage équitable » (fair use)
Malgré la lourde pénalité financière, la victoire juridique revient largement à Anthropic concernant le principe fondamental de l'entraînement de l'IA. Dans une décision qui a provoqué une onde de choc dans l'industrie technologique, le juge Alsup a statué que l'entraînement d'un modèle d'IA sur des textes protégés par le droit d'auteur constitue un « usage équitable » (fair use).
Cette distinction est cruciale : le tribunal n'a pas sanctionné Anthropic pour l'acte d'apprendre à partir du texte, mais plutôt pour la méthode d'acquisition — plus précisément l'utilisation de répertoires piratés. En séparant la légalité de l'entraînement des modèles de la légalité de l'approvisionnement en données, le tribunal a fourni un bouclier juridique important aux laboratoires d'IA, à condition qu'ils puissent prouver que leurs ensembles d'entraînement sont acquis par des voies légitimes.
Pourquoi cela ne met pas fin à la guerre juridique de l'IA
Bien que cette affaire ferme un chapitre pour Anthropic, elle n'établit pas de précédent national contraignant. Comme Anthropic a choisi de conclure un accord, l'affaire n'atteindra jamais une cour d'appel pour fixer une règle définitive pour l'ensemble de l'industrie. Par conséquent, la question de l'« usage équitable » reste un champ de bataille ouvert pour les autres acteurs majeurs.
Le paysage de l'IA est actuellement confronté à une vague de litiges similaires. Des entreprises telles que Google, Meta, Midjourney et OpenAI font toutes face à des poursuites judiciaires actives concernant leurs méthodologies d'entraînement. Par exemple, un récent recours collectif impliquant des poids lourds tels que Hachette, Cengage et Elsevier accuse Google d'utiliser des œuvres protégées par le droit d'auteur pour entraîner sa plateforme Gemini. Tant qu'une juridiction supérieure ne rendra pas une décision définitive, le statut juridique de l'entraînement de l'IA restera un assemblage disparate de décisions de niveau de district.
Points clés à retenir
- Versement historique : Anthropic versera 1,5 milliard de dollars pour régler les réclamations, en distribuant 3 000 $ par œuvre sur environ 500 000 œuvres protégées par le droit d'auteur.
- Précédent de l'usage équitable : Le tribunal a statué que l'entraînement de modèles d'IA sur des textes protégés par le droit d'auteur constitue un « usage équitable », bien que l'utilisation spécifique de sources piratées ait été jugée illégale.
- L'incertitude juridique demeure : Comme il s'agissait d'un accord et non d'une décision d'appel, la légalité de l'entraînement de l'IA reste incertaine pour des entreprises comme OpenAI, Google et Meta.
