虎嗅

**Anthropics règle pour 1,5 milliard de dollars : L'affaire est close, mais les problèmes juridiques ne font que commencer.**

原文:Anthropic15亿美元和解:案件已了,法律问题才刚开始

Résumé des principaux points

Anthropic a payé 1,5 milliard de dollars de dommages-intérêts pour avoir utilisé des livres piratés pour entraîner son modèle d'intelligence artificielle Claude (environ 500 000 ouvrages, à environ 3 000 dollars l'unité), ce qui constitue la plus grosse transaction de règlement de droits d'auteur dans l'histoire de l'intelligence artificielle. Cependant, il est important de noter que ces fonds correspondent à des frais de règlement pour les données piratées et non à des licences d'entraînement légales. Ce règlement ne crée pas de précédent juridique contraignant, et les bénéfices réels des auteurs sont limités. Le Congrès américain travaille actuellement sur des lois pour obliger les entreprises d'intelligence artificielle à divulguer leurs données d'entraînement, rendant les règles relatives aux droits d'auteur pour l'entraînement de l'IA incertaines à l'avenir.

I. 1,5 milliard de dollars : une amende pour piratage, pas des frais d'entraînement en IA

Pour comprendre ce règlement, il est nécessaire de se référer à la décision d'un juge en 2025 : l'utilisation de données légales (par exemple, des livres achetés et scannés) pour l'entraînement de l'IA est considérée comme une utilisation raisonnable et ne nécessite pas de paiement. En revanche, la téléchargement et le stockage de plus de 7 millions de livres depuis des bibliothèques piratées telles que LibGen constitue une violation claire des droits d'auteur.

Pourquoi Anthropic a-t-il accepté de payer 1,5 milliard de dollars ? Selon la législation américaine sur les droits d'auteur, la réparation maximale pour une violation intentionnelle est de 150 000 dollars par ouvrage, ce qui représenterait en théorie 1 trillion de dollars pour 7 millions d'ouvrages. Le montant de 1,5 milliard de dollars sert donc à éviter des coûts exorbitants.

Ainsi, les 3 000 dollars par ouvrage ne correspondent pas à des frais de licence, mais plutôt au prix payé pour régler les conséquences du piratage. Si les entreprises d'IA utilisaient des données légales pour leur entraînement, elles n'auraient peut-être même pas à payer quoi que ce soit aux auteurs.

II. Ce règlement n'est pas un jugement définitif ; d'autres affaires peuvent encore faire l'objet de contestations

Anthropic affirme avoir gagné, car le juge a déclaré que l'utilisation de données légales pour l'entraînement de l'IA était considérée comme une utilisation raisonnable. Cependant, aux États-Unis, seul un jugement final d'une cour d'appel constitue un précédent juridique contraignant. Ce règlement est le résultat d'une étape préjudiciaire, et l'opinion du juge n'est qu'une référence.

De nombreuses affaires relatives aux droits d'auteur sur l'IA sont encore en cours : une cour de New York examine l'affaire Google Gemini, tandis qu'une cour de Californie examine celle de Meta, et les juges ont des opinions divergentes. Certains juges estiment que l'entraînement de l'IA peut menacer les revenus des auteurs, contrairement à celui de cet affaire.

De plus, six auteurs ont quitté le règlement pour intenter des poursuites séparément, et 350 grands éditeurs/détenteurs de droits ont renoncé à l'accord de 3 000 dollars par ouvrage, espérant obtenir des indemnisations plus élevées. Cela montre que personne n'est entièrement satisfait du résultat de ce règlement.

III. Les auteurs ne gagnent pas beaucoup ; les fonds sont soustraits à plusieurs reprises

Le montant de 1,5 milliard de dollars semble important, mais les auteurs en reçoivent très peu réellement :

1. Déductions de coûts : 122 millions de dollars sont d'abord prélevés pour couvrir les honoraires des avocats, les frais judiciaires et les frais de gestion (selon les demandes initiales des avocats, cela pourrait représenter entre 25 % et 30 % du montant total).

2 Partage avec les éditeurs : Le reste est divisé à parts égales entre les auteurs et les éditeurs.

3 Les petits auteurs sont encore plus lésés : Avec le retrait des grands éditeurs, la plupart des auteurs restants dans le cadre du règlement sont de petits auteurs, ce qui signifie qu'ils ne reçoivent probablement que 1 500 dollars par ouvrage, soit moins de 2 % du montant maximal des indemnisations légales.

De nombreux auteurs s'opposent à ce règlement, estimant que l'indemnisation est trop faible ou que la répartition est injuste. Il s'agit là d'une sorte de « victoire » après une violation des droits d'auteur, mais ils ne reçoivent en réalité que les restes.

IV. Le Congrès cherche à rendre plus transparent l'entraînement de l'IA ; l'avenir s'annonce compliqué

Le Congrès américain promeut deux projets de loi visant à obliger les entreprises d'intelligence artificielle à divulguer leurs données d'entraînement :

  • Le projet de loi CLEAR : Avant la sortie d'un produit, les entreprises d'IA doivent soumettre une liste des œuvres protégées par des droits d'auteur utilisées dans leurs données d'entraînement, et ces données seront rendues publiques par l'office des droits d'auteur.
  • Le projet de loi TRAIN : Les détenteurs de droits d'auteur pourront demander des ordonnances judiciaires pour vérifier si leurs œuvres ont été utilisées dans l'entraînement des modèles d'IA.

Ces projets de loi ne déterminent pas directement si l'entraînement de l'IA constitue une violation des droits d'auteur, mais donnent aux détenteurs de droits d'auteur le droit de vérifier les preuves. À l'avenir, ils pourront facilement savoir qui utilise leurs œuvres et choisir soit de poursuivre en justice, soit de négocier des licences avec les entreprises d'IA, rendant plus difficile pour ces dernières de continuer à utiliser des données piratées.

V. L'affaire est close, mais la « guerre » sur les droits d'auteur pour l'IA ne fait que commencer

Ce règlement n'est qu'un premier pas pour Anthropic ; le problème des droits d'auteur dans le contexte de l'entraînement de l'IA est loin d'être résolu :

  • L'interprétation du juge concernant l'utilisation raisonnable des données n'est pas définitive, et d'autres affaires pourraient déterminer que l'entraînement de l'IA constitue une violation.
  • Les projets de loi du Congrès augmenteront le nombre de poursuites contre les entreprises d'IA.
  • Le montant de 3 000 dollars par ouvrage ne sera probablement pas le standard futur ; des indemnisations ou des licences plus élevées pourraient être exigées.

Pour les grandes entreprises d'intelligence artificielle, la véritable question est de savoir si les données utilisées pour l'entraînement pourront un jour être rendues publiques et à quel point cela augmentera les coûts.

En somme, cet accord de 1,5 milliard de dollars n'est qu'un épisode parmi d'autres ; le jeu des droits d'auteur dans le domaine de l'IA est loin d'être terminé.