Google: class action negli USA per i libri usati per addestrare Gemini
Google avrebbe usato milioni di libri e riviste coperti da copyright per addestrare Gemini, il modello di intelligenza artificiale dell’azienda. È questa l’accusa al centro della class action federale presentata il 10 luglio 2026 davanti al tribunale del Southern District of New York da un gruppo di editori guidato da Hachette Book Group, Cengage Learning ed Elsevier, insieme allo scrittore Scott Turow, come risulta dalla denuncia.
Il cuore della causa è piuttosto chiaro. Secondo i ricorrenti, Google avrebbe impiegato senza permesso una quantità enorme di opere protette, tanto che nell’atto si parla apertamente di una delle più grandi violazioni del diritto d’autore mai contestate.
Google sotto accusa per l’uso di libri protetti in Gemini
Per i querelanti, Google non si sarebbe fermata al materiale normalmente disponibile sul mercato. Avrebbe anche riutilizzato copie digitali ricevute in origine per scopi molto più circoscritti, come Google Books e Google Play. Dal punto di vista degli editori, quelle copie non potevano essere spostate su finalità commerciali del tutto diverse senza un’autorizzazione esplicita.
Nella denuncia vengono richiamati vari elementi che andrebbero in questa direzione. Tra le opere citate negli atti compaiono anche titoli conosciuti come The Fifth Season di N.K. Jemisin e Who Could That Be at This Hour? di Lemony Snicket, indicati nei documenti come esempi di testi che sarebbero finiti nel materiale usato da Google.
C’è poi un passaggio particolarmente sensibile, quello che riguarda alcuni documenti interni menzionati nella causa. I querelanti sostengono che dentro Google ci fosse consapevolezza del rischio legale, al punto che un dipendente avrebbe stimato una possibile esposizione economica tra i 10 e i 100 miliardi. Per ora, almeno stando agli atti del procedimento, Google non ha ancora risposto nel merito alle accuse.
Il nodo delle copie digitali e il danno al mercato
Per gli editori, la questione non si esaurisce nell’uso non autorizzato delle opere. C’è anche il danno economico.
Nella denuncia si sostiene infatti che Gemini sia ormai in grado di generare contenuti concorrenti a partire dal materiale usato in fase di addestramento.
L’esempio scelto dai ricorrenti rende bene l’idea: secondo quanto riportato nell’atto, il sistema potrebbe scrivere un giallo di 100 pagine in circa 20 minuti, con un costo di 0,39 dollari. Per i querelanti, uno scenario del genere finirebbe per intaccare il valore economico del lavoro umano di autori ed editori.
Cosa chiedono gli editori a Google
Sul piano legale, la causa comprende accuse di violazione diretta e indiretta del copyright, oltre a presunte violazioni del Digital Millennium Copyright Act, il DMCA, cioè la normativa statunitense che tutela anche le informazioni sul diritto d’autore quando vengono rimosse o modificate.
I ricorrenti chiedono i danni previsti dalla legge, un’ingiunzione definitiva per bloccare l’uso contestato e la distruzione delle copie impiegate senza autorizzazione, sempre secondo quanto riportato nella denuncia.
Il procedimento si inserisce dentro una stagione di contenziosi molto più ampia che sta investendo diverse aziende del settore, da Meta a OpenAI fino ad Anthropic. Fin qui i risultati sono stati discontinui: in California alcune società hanno ottenuto decisioni favorevoli sul fair use, mentre in altri casi si è arrivati a accordi milionari, come quello che ha coinvolto Anthropic per l’uso di libri piratati.
Per Google, quindi, la partita aperta a New York potrebbe pesare ben oltre questo singolo caso. In gioco non c’è soltanto Gemini, ma il modo in cui un intero settore costruisce i propri modelli a partire da contenuti creati da altri. E alla fine la domanda resta quella più scomoda: si può davvero accettare che aziende dell’AI costruiscano prodotti commerciali su opere protette senza un permesso esplicito?