Anthropic erzielt 1,5-Milliarden-Dollar-Vergleich in wegweisendem KI-Urheberrechtsstreit

Ein Bundesrichter hat offiziell den massiven 1,5-Milliarden-Dollar-Vergleich von Anthropic mit Autoren und Verlagen genehmigt, was einen historischen Moment im Rechtsstreit um KI-Trainingsdaten markiert. Während die Zahlung die höchste in der US-Urheberrechtsgeschichte ist, schafft die zugrunde liegende rechtliche Entscheidung eine komplexe Landschaft für die Zukunft der Entwicklung generativer KI.

Die finanzielle Aufschlüsselung und das Piraterie-Problem

Der Vergleich folgt auf eine Sammelklage, bei der es im Kern darum ging, wie Anthropic die zum Training seiner großen Sprachmodelle verwendeten Daten erworben hat. Das Gericht stellte fest, dass Anthropic zwar einige Bücher gekauft, aber auch Millionen urheberrechtlich geschützter Werke illegal von Piraterie-Seiten wie Library Genesis und Pirate Library Mirror heruntergeladen hatte.

Um den Rechtsstreit beizulegen und einen potenziell noch schädlicheren Prozess vor einer Jury zu vermeiden, erklärte sich Anthropic bereit, eine Zahlung von 3.000 $ pro Werk für schätzungsweise 500.000 Werke zu leisten. Diese Mittel werden unter den Autoren und Verlagen aufgeteilt, die die Rechte an dem verletzten Material halten. Richterin Araceli Martinez-Olguin unterzeichnete die endgültige Genehmigung und schloss damit einen Prozess ab, der unter dem vorherigen Richter William Alsup begonnen hatte.

Ein kontroverser Sieg für „Fair Use“

Trotz der massiven finanziellen Strafe gehört der rechtliche Sieg in Bezug auf das Kernprinzip des KI-Trainings weitgehend Anthropic. In einer Entscheidung, die Schockwellen durch die Tech-Branche gesendet hat, entschied Richter Alsup, dass das Training eines KI-Modells mit urheberrechtlich geschützten Texten „Fair Use“ darstellt.

Diese Unterscheidung ist entscheidend: Das Gericht bestrafte Anthropic nicht für den Akt des Lernens aus dem Text, sondern für die Art des Erwerbs – insbesondere die Nutzung von Piraterie-Repositories. Durch die Trennung der Rechtmäßigkeit des Modelltrainings von der Rechtmäßigkeit der Datenbeschaffung hat das Gericht einen bedeutenden rechtlichen Schutzschild für KI-Labore geschaffen, sofern diese nachweisen können, dass ihre Trainingsdatensätze über legitime Kanäle erworben wurden.

Warum dies den KI-Rechtskrieg nicht beendet

Während dieser Fall das Kapitel für Anthropic abschließt, schafft er keinen bindenden nationalen Präzedenzfall. Da Anthropic sich für einen Vergleich entschied, wird der Fall niemals ein Berufungsgericht erreichen, um eine definitive Regel für die gesamte Branche festzulegen. Folglich bleibt die „Fair Use“-Frage ein offenes Schlachtfeld für andere große Akteure.

Die KI-Landschaft sieht sich derzeit einer Welle ähnlicher Rechtsstreitigkeiten gegenüber. Unternehmen wie Google, Meta, Midjourney und OpenAI sehen sich alle mit laufenden Klagen bezüglich ihrer Trainingsmethoden konfrontiert. Beispielsweise wirft eine jüngste Sammelklage, an der Schwergewichte wie Hachette, Cengage und Elsevier beteiligt sind, Google vor, urheberrechtlich geschützte Werke zum Training seiner Gemini-Plattform zu verwenden. Bis ein höheres Gericht eine endgültige Entscheidung trifft, bleibt der rechtliche Status des KI-Trainings ein Flickenteppich aus Entscheidungen auf Distriktebene.

Wichtigste Erkenntnisse

  • Historische Zahlung: Anthropic wird 1,5 Milliarden Dollar zahlen, um Ansprüche beizulegen, wobei 3.000 $ pro Werk für etwa 500.000 urheberrechtlich geschützte Werke verteilt werden.
  • Fair-Use-Präzedenzfall: Das Gericht entschied, dass das Training von KI-Modellen mit urheberrechtlich geschützten Texten „Fair Use“ ist, obwohl die spezifische Nutzung von Pirateriequellen als illegal eingestuft wurde.
  • Rechtliche Unsicherheit bleibt bestehen: Da es sich um einen Vergleich und nicht um ein Urteil eines Berufungsgerichts handelte, bleibt die Rechtmäßigkeit des KI-Trainings für Unternehmen wie OpenAI, Google und Meta ungeklärt.