Auteurs dagen Google voor de rechter wegens vermeend gebruik van auteursrechtelijk beschermde boeken voor Gemini training

Auteurs dagen Google voor de rechter

Hachette Book Group, Cengage Learning, Elsevier, auteur Scott Turow en S.C.R.I.B.E., Inc. hebben een voorgestelde federale massaclaim rechtszaak aangespannen tegen Google.

Zij beschuldigen het bedrijf ervan auteursrechtelijk beschermde boeken en wetenschappelijke artikelen zonder toestemming te hebben gekopieerd om de Gemini AI modellen te trainen. De rechtszaak werd op 10 juli 2026 ingediend. De zaak, Hachette Book Group Inc. et al. v. Google LLC, is geregistreerd onder zaaknummer 1:26-cv-05870 bij de U.S. District Court for the Southern District of New York.

In de aanklacht worden de vermeende handelingen van Google omschreven als “een van de meest omvangrijke schendingen van auteursrechtelijk beschermd materiaal in de geschiedenis”. Deze beschuldigingen zijn echter nog niet door een rechtbank bewezen en er is nog geen uitspraak gedaan over de aansprakelijkheid van Google.

De juridische claims en uitgeversovereenkomsten die centraal staan in de Gemini rechtszaak

De eisers voeren vier juridische claims aan; directe auteursrechtinbreuk, medeplichtigheid aan auteursrechtinbreuk, het verwijderen of wijzigen van auteursrechtbeheerinformatie en overtredingen van de Digital Millennium Copyright Act (DMCA).

Volgens hen heeft Google beschermde werken verkregen via zijn boekendiensten, internetscraping en andere bronnen, waarna de inhoud werd gebruikt om Gemini te trainen.

Uitgevers leverden boeken en wetenschappelijke artikelen aan Google Books, Google Play Books en Google Scholar op basis van overeenkomsten die specifieke toepassingen toestonden, zoals het tonen van doorzoekbare fragmenten, de distributie van e-books en het helpen van gebruikers bij het vinden van wetenschappelijke publicaties.

Volgens de eisers gaven deze overeenkomsten Google geen toestemming om volledige werken te kopiëren naar datasets die worden gebruikt voor de commerciële ontwikkeling van generatieve AI. Zij stellen dat Google materiaal dat via bestaande samenwerkingen met uitgevers was verkregen, heeft hergebruikt voor doeleinden die niet onder de contracten vielen.

In de aanklacht staat verder dat Google boeken en ander beschermd materiaal verzamelde via grootschalige internetscraping, waaronder van piratenwebsites en publicaties die achter betaalmuren of abonnementen beschikbaar waren.

Waarin deze Gemini zaak verschilt van Google Books en wat interne e-mails zouden laten zien

Google won eerder een auteursrechtzaak over het digitaliseren van boeken voor zoekfuncties en fragmentweergaven. In 2015 oordeelde een federaal hof van beroep dat deze toepassingen transformerend waren en onder het fair use beginsel vielen.

De eisers stellen dat die uitspraak uitsluitend betrekking had op doorzoekbare boekendatabases en beperkte fragmenten, niet op het gebruik van volledige boeken voor het trainen van generatieve AI-modellen.

Volgens hen dient AI-training een ander commercieel doel en leidt deze tot systemen die kunnen concurreren met de oorspronkelijke werken waarop zij zijn getraind. Zij stellen dat het fundamentele verschil ligt tussen digitalisering voor zoekfunctionaliteit en het trainen van generatieve AI-modellen, wat de kern vormt van hun zaak.

Volgens de aanklacht waarschuwde een Google medewerker tijdens een interne discussie dat het gebruik van boeken die via Google Play uitgeversovereenkomsten waren verkregen voor AI-ontwikkeling aanzienlijke juridische risico’s met zich mee kon brengen. Die medewerker zou hebben geschat dat dergelijke praktijken konden leiden tot boetes tussen de 10 en 100 miljard dollar.

Andere interne documenten die in de aanklacht worden genoemd, zouden erop wijzen dat Google bewust op zoek was naar professioneel geschreven boeken om de prestaties van Gemini te verbeteren.

De eisers stellen dat tests aantoonden dat modellen die uitsluitend met publiek domein boeken waren getraind, slechter presteerden dan modellen die ook auteursrechtelijk beschermde werken bevatten. Volgens de aanklacht wilde Google daarom werken opnemen met zorgvuldig samengestelde feiten, gestructureerde analyses, fictieve verhalen en professioneel geredigeerde teksten.

Werken die in de aanklacht worden genoemd en waarvan Gemini wordt beschuldigd inhoud te genereren

De aanklacht noemt verschillende werken als voorbeeld. Hachette verwijst naar The Wild Robot van Peter Brown, The Fifth Season van N.K. Jemisin, Moon Glacier National Park van Becky Lomax en Who Could That Be at This Hour? van Lemony Snicket.

Daarnaast wordt Innocent van Scott Turow genoemd. Cengage verwijst naar Cognitive Psychology, Principles of Economics, Milady Standard Barbering, Nutrition: Concepts and Controversies en Calculus: Early Transcendentals. Elsevier verwijst naar auteursrechtelijk beschermde wetenschappelijke artikelen.

Scott Turow en S.C.R.I.B.E. noemen daarnaast Presumed Innocent, Innocent en Testimony. Volgens de eisers vormen deze voorbeelden slechts een klein deel van de boeken en artikelen die volgens hen zijn gekopieerd in verband met Gemini.

In de aanklacht worden voorbeelden gegeven om te laten zien dat Gemini inhoud kan genereren die verband houdt met specifieke beschermde boeken. Volgens de eisers produceerde Gemini inhoud gebaseerd op The Fifth Season en gaf het antwoorden met personages, gebeurtenissen en details uit Who Could That Be at This Hour? Ook stellen zij dat Gemini goedkope alternatieven kan genereren voor professioneel uitgegeven boeken.

Volgens de eisers kan de dienst bijvoorbeeld binnen ongeveer twintig minuten voor 39 dollarcent een detectiveverhaal van 100 pagina’s schrijven dat zich afspeelt in een rustig kustplaatsje. In de aanklacht staat: “Geen enkele uitgever of auteur kan daarmee concurreren.” Deze tijd- en kostenramingen zijn afkomstig van de eisers en zijn nog niet door de rechtbank vastgesteld.

Wie zich mogelijk bij de massaclaim kan aansluiten en welke maatregelen worden geëist

De voorgestelde massaclaim zou eigenaren omvatten van geregistreerde auteursrechten op boeken met een International Standard Book Number (ISBN), evenals wetenschappelijke artikelen die zijn geïdentificeerd met een Digital Object Identifier (DOI) of International Standard Serial Number (ISSN).

Om deel uit te maken van de groep moeten rechthebbenden volgens het voorstel kunnen aantonen dat Google hun werken heeft gekopieerd via een van zijn diensten, heeft verkregen via webscraping of heeft gebruikt voor de training van Gemini. De rechtbank heeft deze voorgestelde groep nog niet gecertificeerd.

De eisers vragen om wettelijke schadevergoedingen of compensatie op basis van hun gestelde schade en de vermeende winst van Google, evenals vergoeding van juridische kosten en andere rechtsmiddelen die beschikbaar zijn onder de Amerikaanse auteursrechtwetgeving.

Daarnaast vragen zij de rechtbank Google via een gerechtelijk bevel te verbieden door te gaan met wat zij omschrijven als ongeoorloofd kopiëren van beschermde boeken en artikelen voor Gemini training en aanverwante AI-ontwikkeling.

Ook verzoeken zij om een volledig overzicht van de werken en methoden die Google heeft gebruikt om Gemini te trainen. Dit omvat informatie over welke materialen zijn gebruikt, waar deze vandaan kwamen en hoe zij in de systemen van Google zijn verwerkt.

Verder vragen de eisers om vernietiging, onder toezicht van de rechtbank, van de vermeend inbreukmakende kopieën en datasets die uit hun werken zijn afgeleid. Het is nog onduidelijk of een dergelijke maatregel juridisch uitvoerbaar of passend wordt geacht.

Uitgevers, auteurs en houders van academische rechten die mogelijk onder de voorgestelde massaclaim vallen, doen er volgens de aanklacht goed aan na te gaan welke van hun werken zijn geregistreerd bij het U.S. Copyright Office, aangezien de voorgestelde groep is gebaseerd op geregistreerde werken met ISBN-, DOI- of ISSN-identificatie.

Daarnaast wordt geadviseerd bestaande overeenkomsten met Google Books, Google Play Books en Google Scholar te controleren om inzicht te krijgen in welke gebruiksvormen daarin zijn toegestaan.

Ook wordt aangeraden publicatiedata, distributiekanalen en communicatie met Google over mogelijk gebruik van hun werken voor AI-trainingsdatasets goed te documenteren. Het volgen van de procedure rond de certificering van de massaclaim kan eveneens belangrijk zijn, omdat deelname uiteindelijk afhangt van de beslissing van de rechtbank.

De huidige stand van de rechtszaak van Hachette en Cengage tegen Google

Hachette en Cengage probeerden eerder al deel te nemen aan een afzonderlijke auteursrechtzaak die in 2023 in Californië tegen Google werd aangespannen door auteurs en beeldend kunstenaars. Google verzette zich tegen hun deelname, waarna de uitgevers zich terugtrokken en later de huidige zaak in New York indienden.

Google heeft nog geen uitgebreide openbare reactie gegeven op de specifieke beschuldigingen in de New Yorkse aanklacht. Het bedrijf krijgt de gelegenheid om te reageren terwijl de zaak verdergaat via processtukken, mogelijke bewijsvergaring en de procedure rond certificering van de massaclaim. Er is nog geen procesdatum vastgesteld en de rechtbank heeft zich nog niet uitgesproken over een van de vier aangevoerde claims.