Radar · 22/07/2026 · survenu le 21/07/2026 · business

Anthropic approuve le règlement de 1,5 milliard de dollars pour les livres piratés utilisés pour entraîner Claude

Un juge fédéral a approuvé l’accord de 1,5 milliard de dollars entre Anthropic et un groupe d’auteurs qui avaient dénoncé l’utilisation de livres protégeables par le droit d’auteur pour entraîner Claude. Les auteurs reçoivent environ 3 000 dollars par livre, et plus de 91% des titulaires impliqués ont réclamé leur part. Le cabinet juridique des demandeurs le décrit comme la plus grande indemnisation pour violation de droit d’auteur de l’histoire.

Pourquoi cela te concerne. Si tu construis quelque chose au-dessus d’un modèle entraîné par d’autres, le coût d’entraînement était jusqu’à présent un chiffre opaque : tu sais ce que tu paies pour l’inférence, pas ce qu’il a coûté de mettre les données dans le modèle. Cet accord fait deux choses concrètes. Il fixe un prix par livre utilisé sans licence : 3 000 dollars. Et il transfère le risque vers celui qui entraîne aujourd’hui. Si demain tu assembles un dataset avec du matériel protégé, le précédent indique ce qui peut se passer.

Ce n’est pas limité à Anthropic. D’autres causes similaires sont encore en cours. Ceux qui entraînent leurs propres modèles ou font du fine-tuning sur des données collectées sur le web font face à un contexte qui se précise. Comme nous le notions le 14 juillet en reprenant les critiques de Nadella envers les labs qui entraînent sur les données d’autrui, la pratique est généralisée. Elle a maintenant un prix.

En détail

L’action en justice avait commencé en 2024. Andrea Bartz, Charles Graeber et Kirk Wallace Johnson avaient accusé Anthropic d’avoir téléchargé des millions de livres protégeables d’une manière que le juge William Alsup avait qualifiée de « téléchargement de style Napster ». Le terme utilisé par Alsup, qui a pris sa retraite par la suite, illustre un prélèvement massif et automatisé depuis des archives numériques sans autorisation. Lors des audiences précédentes, Alsup avait accordé à Anthropic une victoire partielle sur l’utilisation transformative, reconnaissant que transformer un texte pour entraîner un modèle peut relever du fair use, mais avait néanmoins certifié l’action collective pour piratage systématique, laissant ouverte la question des dommages-intérêts.

Anthropic a accepté les 1,5 milliard en septembre 2025. La juge Araceli Martínez-Olguín a signé l’approbation définitive lundi 21 juillet 2026, déclarant que l’accord offrait un « meaningful relief » aux auteurs. La signature définitive intervient près d’un an après l’annonce, le temps nécessaire pour vérifier les demandes de compensation et gérer les objections de ceux qui estimaient la somme insuffisante.

Les chiffres. L’indemnisation moyenne est d’environ 3 000 dollars par livre. Le cabinet juridique des demandeurs le définit comme le plus grand recouvrement de droits d’auteur jamais obtenu aux États-Unis, un record qui pèse sur tout le secteur. Anthropic déclare que plus de 91% des auteurs et éditeurs impliqués ont réclamé leur part, et l’avocat général Aparna Sridhar parle de « clore la question ». Le pourcentage élevé d’adhésion indique que la plupart des intéressés ont préféré encaisser immédiatement plutôt que de poursuivre au tribunal avec un résultat incertain.

La clôture est partielle. Chicken Soup for the Soul et d’autres auteurs ont toujours des actions en cours contre Anthropic, arguant que 3 000 dollars par livre ne suffisent pas à couvrir le préjudice découlant de l’utilisation commerciale de leurs œuvres. TechCrunch note que l’accord clôt un cas mais ne résout pas le problème plus large de l’utilisation d’œuvres protégeables pour entraîner les modèles. La question fondamentale de savoir si l’entraînement sur des données protégeables est légal en soi reste en suspens.

Ce qui change pour ceux qui construisent. Le précédent rend quantifiable le risque juridique de l’entraînement sur des données sans licence. Si tu assembles un dataset pour du fine-tuning ou pour entraîner un modèle de zéro, et que du contenu protégé s’y retrouve, tu sais maintenant l’ordre de grandeur de la facture potentielle. Tu dois te demander si les marges de ton application supporteraient une indemnisation calculée à une échelle similaire. Cela s’applique aussi si tu utilises un modèle d’un tiers : le fournisseur qui a entraîné sur des données piratées porte avec lui un risque qui était auparavant théorique et qui a maintenant un chiffre attaché. Choisir un modèle, c’est aussi hériter de son exposition juridique.

Les limites de ce que nous savons. L’accord concerne un cas spécifique et une classe spécifique d’auteurs. Ce n’est pas un jugement au fond sur le fair use pour l’entraînement d’IA : c’est un accord transactionnel qui évite le procès. Les actions encore en cours pourraient établir des précédents différents, peut-être plus favorables aux labs ou plus punitifs. Et le prix de 3 000 dollars par livre est spécifique à cet accord, pas un tarif général applicable à tous. Les négociations futures dépendront de la visibilité des œuvres et de la valeur commerciale du modèle entraîné.

Tapez pour chercher dans cours, playbooks, skills, papers…