Acquisition2025-06-23confirmed

Anthropic PBC × Various booksellers

Dans un procès en violation de droits d'auteur intenté par des auteurs, les procédures judiciaires en juin 2025 ont révélé que la société d'IA Anthropic avait acheté des millions de livres imprimés, les avait physiquement démontés et numérisés, et avait utilisé les fichiers numériques résultants pour entraîner ses modèles d'IA Claude. [30, 32] Dans une décision rendue le 23 juin 2025, un juge fédéral à San Francisco a déterminé que ce processus d'achat d'un livre physique, de sa numérisation et de la destruction de l'original pouvait être considéré comme une utilisation transformatrice "d'usage loyal" en vertu du droit d'auteur américain. [28, 30] Ceci était distinct de l'utilisation par la société de livres numériques piratés, que le tribunal a jugée contrefaisante. [30]

Price paid
Not disclosed
Losing bid
Per unit
no meaningful ratio

The asset

L'achat de millions de livres imprimés physiques, qui ont ensuite été numérisés via un "scan destructif" et utilisés comme données d'entraînement pour le grand modèle linguistique Claude.

  • 1M books

The record

Seller status
Going concern
Sector
Book retail
Modalities
text
Jurisdiction
US
Docket
24-cv-05417

What it means if you hold data

Cette affaire met en évidence une méthode nouvelle et juridiquement distincte pour acquérir des données d'entraînement : l'achat en gros et la numérisation de médias physiques. La décision du tribunal sur l'"usage loyal" de cette pratique spécifique, à condition que les livres soient acquis légalement, crée une voie potentielle pour que les laboratoires d'IA s'approvisionnent en données de haute qualité en dehors des accords de licence directs avec les éditeurs, bien qu'avec des coûts logistiques importants.

Sources