Anthropic PBC × Various booksellers
In una causa per violazione del copyright intentata dagli autori, i procedimenti giudiziari nel giugno 2025 hanno rivelato che la società di intelligenza artificiale Anthropic aveva acquistato milioni di libri stampati, li aveva fisicamente smontati e scansionati, e aveva utilizzato i file digitali risultanti per addestrare i suoi modelli di intelligenza artificiale Claude. [30, 32] Con una sentenza del 23 giugno 2025, un giudice federale di San Francisco ha stabilito che questo processo di acquisto di un libro fisico, digitalizzazione e distruzione dell'originale poteva essere considerato "fair use" trasformativo ai sensi della legge sul copyright statunitense. [28, 30] Ciò era distinto dall'uso da parte della società di libri digitali piratati, che la corte ha ritenuto essere una violazione. [30]
The asset
L'acquisto di milioni di libri stampati fisici, che sono stati poi digitalizzati tramite "scansione distruttiva" e utilizzati come dati di addestramento per il modello linguistico di grandi dimensioni Claude.
- 1M books
The record
- Seller status
- Going concern
- Sector
- Book retail
- Modalities
- text
- Jurisdiction
- US
- Docket
- 24-cv-05417
What it means if you hold data
Questo caso evidenzia un metodo nuovo e legalmente distinto per acquisire dati di addestramento: l'acquisto in blocco e la digitalizzazione di supporti fisici. La sentenza "fair use" della corte su questa pratica specifica, a condizione che i libri siano legalmente acquisiti, crea un percorso potenziale per i laboratori di intelligenza artificiale per reperire dati di alta qualità al di fuori di accordi di licenza diretti con gli editori, sebbene con significativi costi logistici.