Un miliardo e mezzo per voltare pagina: Anthropic chiude i conti con gli autori | Llm wikipedia | Nlp e llm | Chatgpt test | Turtles AI
Anthropic ha accettato di versare 1,5 miliardi di dollari per risarcire gli autori i cui libri piratati sono stati usati per addestrare il chatbot Claude. L’accordo, in attesa di approvazione giudiziale l’8 settembre 2025, impone anche la distruzione dei dataset illeciti e richiama interrogativi sulle responsabilità e pratiche delle aziende AI nella raccolta dati.
Punti chiave:
- Il risarcimento ammonta a circa 3.000 $ per ciascuna delle circa 500.000 opere interessate
- Anthropic distruggerà i file piratati usati nei dataset illeciti
- Il verdetto preliminare ha riconosciuto il fair use per libri acquistati legalmente, ma ha condannato la pirateria
- L’accordo potrebbe influenzare cause simili contro OpenAI, Meta, Microsoft, Apple
Nella vicenda che ha messo al centro l’attenzione sulle modalità con cui le large-language model vengono istruite, Anthropic, startup fintech sostenuta da Amazon e Alphabet, ha deciso di negoziare un’intesa da 1,5 miliardi di dollari con un gruppo di autori rappresentativi tra cui Andrea Bartz, Charles Graeber e Kirk Wallace Johnson che portavano avanti una class action nata nell’agosto 2024. I querelanti sostenevano che l’azienda aveva estratto milioni di libri da biblioteche “ombra” come LibGen e Pirate Library Mirror fino a oltre sette milioni secondo il giudice Alsup e li aveva conservati per l’addestramento del modello Claude, ma senza alcuna autorizzazione.
In una sentenza dello scorso giugno, il giudice statunitense ha affermato che l’effettivo uso dei testi acquistati e digitalizzati da Anthropic rientrava nel “fair use”: l’impiego trasformativo simile a leggere per imparare a scrivere può essere lecito. Tuttavia, ha condannato la conservazione di copie chiaramente illegali nella cosiddetta “biblioteca centrale” dell’azienda, che non era coperta da nessuna licenza. La posta in gioco era altissima: se il processo fosse arrivato a dicembre, i danni potevano superare centinaia di miliardi, con possibili conseguenze destabilizzanti per Anthropic.
L’accordo prevede che ogni autore coinvolto possa ricevere circa 3.000 $, con la cifra complessiva potenzialmente incrementabile se venissero incluse ulteriori opere nel computo finale. Oltre ai risarcimenti, l’azienda si impegna a distruggere i file piratati presenti nei suoi archivi. In pratica, annulla ogni uso illecito del materiale piratato, anche se va sottolineato non ammette alcuna responsabilità formale.
Sul fronte dell’impatto nel settore, l’accordo suggerisce che per le aziende AI il costo legale di pratiche scorrette può essere visto come una voce di spesa operativa piuttosto che un incidente isolato. Diverse cause analoghe sono in corso contro Microsoft, Meta, OpenAI, e persino Apple (per il suo modello OpenELM). Si delinea dunque un contesto in cui diventa cruciale la responsabilità delle aziende in merito alla provenienza dei dati utilizzati per addestrare i loro sistemi: la moralità e la legittimità dei metodi di raccolta sono sotto la lente, così come il ruolo dei contratti di licenza o delle acquisizioni autorizzate.
Nel contesto dei modelli generativi, il caso evidenzia la differenza giuridica tra addestramento su testi acquistati e trasformati che può essere ammesso come fair use e l’uso di testi illeciti la cui acquisizione viola il diritto d’autore. Resta in sospeso la questione se la legislazione debba evolvere verso requisiti più rigorosi di trasparenza, tracciabilità e accordi di licenza preventiva con autori o editori. Gli autori e le loro associazioni considerano il risultato una vittoria significativa, mentre gli operatori del settore vedono nella cifra la soglia di quanto si può rischiare se si ignora il rispetto dei diritti d’autore.
Anthropic attende ora l’udienza dell’8 settembre 2025 in tribunale federale a San Francisco, dove il giudice Alsup potrebbe approvare formalmente l’accordo. Da quel momento, si apriranno le procedure di distribuzione dei fondi e di distruzione dei dataset pirata.
Questo sviluppo rappresenta un passaggio concreto su come le aziende AI devono conformarsi alle leggi esistenti, pur senza segnare la fine del dibattito su fair use, sourcing dati e impatti sulle economie creative.


