I documenti giudiziari rivelano il piano segreto di Anthropic per "scansionare distruttivamente tutti i libri del mondo"

Un promemoria interno scoperto in una causa per violazione di copyright mostra che il creatore di Claude ha condotto un progetto di scansione di libri encomiato che ha deliberatamente nascosto sotto un nome in codice.

AI2Day Newsdesk3 min read
Full-frame edge-to-edge photoreal news-editorial image of a darkened server room with rows of humming rack-mounted servers, one rack cordoned off with yellow po
Share

Punti chiave

  • Un caso giudiziale federale nel nord della California, Bartz v Anthropic PBC, ha esposto un progetto interno di Anthropic chiamato "Project Panama" alla fine di luglio 2025.
  • Un promemoria interno ha descritto l'obiettivo del progetto come "scansionare distruttivamente tutti i libri del mondo" per raccogliere dati di addestramento per Claude, l'assistente AI di Anthropic.
  • Lo stesso promemoria ha avvertito il personale di utilizzare il nome in codice perché Anthropic non "voleva che si sapesse" che il lavoro stava avvenendo.
  • Il progetto emerge mentre le aziende di AI affrontano una crescente pressione legale sulla questione se l'utilizzo di libri protetti da diritto d'autore per addestrare i sistemi di AI richieda il permesso degli autori.

Anthropic sviluppa Claude, un modello di linguaggio di grandi dimensioni, ovvero un software addestrato su enormi quantità di testo che può quindi tenere conversazioni, rispondere a domande e scrivere. Come tutti questi sistemi, Claude ha bisogno di enormi quantità di materiale scritto da cui imparare. La provenienza di quel materiale è ora oggetto di cause legali in tutti gli Stati Uniti.

Il documento 21 della corte in Bartz v Anthropic, depositato nel Distretto Settentrionale della California, contiene un promemoria interno che chiede, in modo diretto: "Cos'è Project Panama?" La risposta scritta al suo interno: "Project Panama è il nostro sforzo per scansionare distruttivamente tutti i libri del mondo."

"Distruttivamente" qui è un termine tecnico dal mondo della scansione di libri. Significa tagliare la rilegatura di un libro fisico in modo che le pagine possano essere alimentate attraverso uno scanner rapidamente. Il libro viene rovinato nel processo. È più veloce ed economico rispetto alla scansione a letto piano, ma rimane comunque la scansione di un oggetto protetto da diritto d'autore senza il consenso dell'autore.

Il promemoria non si ferma a descrivere il progetto. Spiega anche perché è stato utilizzato un nome in codice. "[P]erché non vogliamo che si sappia che stiamo lavorando a questo," recita. Quella riga ora si trova in un fascicolo giudiziale pubblico.

Perché questo è importante per gli autori e i lettori?

Gli autori i cui libri sono stati scansionati non hanno voce in capitolo e non ricevono alcun compenso. La legge sul diritto d'autore negli Stati Uniti conferisce ai creatori il diritto esclusivo di riprodurre il loro lavoro. Se l'immissione di un libro scansionato in una pipeline di addestramento di AI conti come quel tipo di riproduzione è precisamente quello che le corti stanno affrontando in questo momento.

Il caso Bartz, riportato per primo da The Guardian, è una delle diverse cause attive che testano questa questione. Una sentenza contraria ad Anthropic potrebbe costringerla a concedere in licenza i libri che ha già utilizzato, pagare i danni, o cambiare il modo in cui raccoglie i dati di addestramento in futuro.

Per i lettori e gli utenti di Claude, l'effetto pratico immediato è minimo: il servizio continua a funzionare mentre il contenzioso procede. Ma se le corti si schierano consistentemente dalla parte degli autori, il costo dell'addestramento dei sistemi di AI potrebbe aumentare notevolmente, il che influenzerebbe quali aziende possono permettersi di svilupparli.

Cosa succede dopo?

Il caso è ancora attivo. Nessun giudizio finale sulla responsabilità è stato emesso. Anthropic non ha commentato pubblicamente il promemoria di Project Panama.

Gli autori che ritengono che il loro lavoro sia stato utilizzato senza consenso possono verificare se i loro titoli compaiono nei dataset che i ricercatori hanno reso pubblici, sebbene non esista ancora un elenco completo delle fonti di addestramento di Anthropic.

La battaglia legale più ampia sui dati di addestramento dell'AI sta procedendo velocemente. Il Congresso ha tenuto audizioni e diversi progetti di legge sono stati proposti, anche se nessuno è passato, che richiederebbero alle aziende di AI di divulgare quale materiale protetto da diritto d'autore hanno utilizzato per l'addestramento.

Domande comuni

Il fatto che Anthropic ammetta questo significa che ha violato la legge?

Non automaticamente. L'utilizzo di materiale protetto da diritto d'autore per l'addestramento dell'AI potrebbe qualificarsi come "fair use", un'eccezione legale che consente la riproduzione limitata senza permesso. Le corti stanno ancora decidendo se questa difesa si applica in questo caso.

Potrebbe questo influenzare altre aziende di AI?

Sì. Cause simili prendono di mira OpenAI, Meta e altri sui dati di addestramento. Una sentenza in Bartz stabilirebbero un precedente che tutti loro stanno seguendo da vicino.

© 2026 AI2Day