Google’s Gemini AI staat voor een collectieve rechtszaak die is aangespannen bij een federale rechtbank in New York, waarin het bedrijf wordt beschuldigd zijn modellen te hebben getraind op auteursrechtelijk beschermde boeken en artikelen zonder toestemming. De klacht, ingediend door een coalitie waaronder grote uitgevers en auteur Scott Turow, stelt dat Google opzettelijk auteursrechtinformatie heeft verwijderd om het gebruik van "gestolen materiaal" in zijn generatieve AI-systeem te verbergen.
De rechtszaak en de kern van de claims
De indiening bij de U.S. District Court voor het Southern District van New York noemt Hachette, Cencage, Elsevier, het S.C.R.I.B.E.-collectief en Turow als eisers. Zij stellen dat Google verder ging dan de "alleen snippets"-regeling die gold voor Google Books, door volledige teksten uit dat archief en uit titels die naar Google Play zijn geüpload te gebruiken om Gemini te trainen. Volgens de klacht heeft Google niet alleen de inhoud gescraped, maar ook auteursrechtelijke metadata gewijzigd of verwijderd, een stap die volgens de eisers bedoeld was om de inbreuk te verbergen.
Een intern Google-memo dat in de rechtszaak wordt aangehaald, waarschuwt dat het gebruik van auteursrechtelijk beschermde boeken voor AI-training "zeer problematisch" kan zijn en het bedrijf kan blootstellen aan boetes variërend van 10 miljard tot 100 miljard dollar. De eisers wijzen naar een recente boete van 1,5 miljard dollar tegen een ander AI-bedrijf voor ongeoorloofd datagebruik als ijkpunt voor de omvang van de potentiële aansprakelijkheid.
Hoe we hier terecht zijn gekomen
De relatie tussen Google en boekenuitgevers begon met Google Books, een doorzoekbare index die korte fragmenten en bibliografische details toonde, terwijl de volledige tekst achter een betaalmuur bleef. Dat model vertrouwde op licentieovereenkomsten die Google beperkten tot het tonen van snippets. In de loop der jaren heeft Google zijn bezit uitgebreid via de Google Play Store, waar uitgevers en auteurs e-books met volledige tekst uploaden om te verkopen.
De eisers betogen dat de verschuiving van Google van een "beperkte reikwijdte" indexeringsdienst naar een databron voor het trainen van large language models (LLM's) de oorspronkelijke overeenkomsten schendt. Ze stellen dat het bedrijf nooit de brede toestemmingen heeft verkregen die nodig zijn om volledige werken op te nemen in de trainingspipeline van Gemini.
Wat er op het spel staat voor Google en de AI-industrie
Als een rechtbank oordeelt dat het gebruik van auteursrechtelijk beschermd materiaal zonder licentie de auteurswet schendt, zou die beslissing de manier waarop AI-ontwikkelaars trainingsdata samenstellen volledig kunnen veranderen.
Mogelijke verdedigingen en tegenargumenten
Google zal zich waarschijnlijk beroepen op de "fair use"-doctrine, die beperkt gebruik van auteursrechtelijk beschermd materiaal toestaat voor commentaar, kritiek of transformatie. Recente uitspraken in Californië hebben AI-training behandeld als een transformerende activiteit, waardoor het bescherming geniet onder fair use. De eisers in New York hebben buiten die jurisdictie een zaak aangespannen om die precedenten te vermijden.
De eisers werpen tegen dat het verwijderen van auteursrechtelijke metadata wijst op de intentie om de bron te verbergen, wat elke claim van te goeder trouw uitgevoerde transformatie ondermijnt. Ze citeren ook het interne memo als bewijs dat Google het juridische risico erkende.
Waar we de komende tijd op moeten letten
De zaak zal door voorbereidende juridische procedures gaan die de argumenten voor beide partijen kunnen vormen, waaronder de vraag of de rechtbank de in Californië gebruikte fair-use-analyse zal toepassen of een andere standaard zal hanteren. Een uitspraak over de jurisdictie kan bepalen of de rechtbanken van New York de belangrijkste locatie worden voor auteursrechtelijke geschillen met betrekking tot AI.
De kern: De rechtszaak in New York tegen Google’s Gemini zou de grens tussen toegestaan datagebruik en auteursrechtinbreuk kunnen hertekenen, waardoor AI-ontwikkelaars gedwongen worden om na te denken over de manier waarop ze de grondstoffen voor hun modellen verwerven, en de economie van de gehele sector kan veranderen.
