IdentifiantMot de passe
Loading...
Mot de passe oublié ?Je m'inscris ! (gratuit)

Vous êtes nouveau sur Developpez.com ? Créez votre compte ou connectez-vous afin de pouvoir participer !

Vous devez avoir un compte Developpez.com et être connecté pour pouvoir participer aux discussions.

Vous n'avez pas encore de compte Developpez.com ? Créez-en un en quelques instants, c'est entièrement gratuit !

Si vous disposez déjà d'un compte et qu'il est bien activé, connectez-vous à l'aide du formulaire ci-dessous.

Identifiez-vous
Identifiant
Mot de passe
Mot de passe oublié ?
Créer un compte

L'inscription est gratuite et ne vous prendra que quelques instants !

Je m'inscris !

La Free Software Foundation révèle que les données d'entraînement IA d'Anthropic comprenaient le livre protégé par le droit d'auteur « Free as in Freedom : Richard Stallman's Crusade for Free Software »

Le , par Anthony

228PARTAGES

10  0 
La Free Software Foundation (FSF) a confirmé que les ensembles de données d'entraînement d'Anthropic comprenaient son ouvrage protégé par le droit d'auteur intitulé « Free as in Freedom : Richard Stallman's Crusade for Free Software ». Cette révélation intervient dans le cadre d'un recours collectif, Bartz c. Anthropic, dans lequel il est allégué qu'Anthropic a illégalement utilisé des documents provenant des bases de données Library Genesis et Pirate Library Mirror pour entraîner ses grands modèles de langage (LLM). Bien que le tribunal ait jugé l'utilisation des livres équitable, la FSF demande aux développeurs d'intelligence artificielle (IA) qui entraînent leurs modèles à l'aide d'énormes ensembles de données téléchargés sur Internet de fournir les LLM à leurs utilisateurs en toute liberté, à titre de compensation.

Anthropic PBC est une entreprise américaine spécialisée dans l'IA dont le siège social est situé à San Francisco. Elle a développé une famille de grands modèles de langage (LLM) baptisée Claude. Anthropic est une société d'intérêt public qui mène des activités de recherche et de développement en IA afin « d'étudier leurs propriétés de sécurité à la pointe de la technologie » et d'utiliser ces recherches pour déployer des modèles sûrs destinés au grand public.

Pour rappel, en juillet 2025, un juge fédéral de Californie a autorisé trois auteurs (Andrea Bartz, Charles Graeber et Kirk Wallace Johnson) à mener une action collective nationale contre la start-up Anthropic, accusée d'avoir téléchargé illégalement des millions d'ouvrages provenant des bibliothèques pirates LibGen et PiLiMi afin d'entraîner son assistant IA, Claude. Le juge William Alsup a estimé que ces auteurs pouvaient représenter l’ensemble des écrivains américains dont les œuvres auraient été utilisées par Anthropic sans autorisation. Selon la plainte, entre 2021 et 2022, Anthropic aurait constitué un vaste référentiel de près de 7 millions de livres téléchargés illégalement dans le but d'entraîner son IA.

La Free Software Foundation (FSF) est une organisation à but non lucratif de type 501(c)(3) fondée par Richard Stallman le 4 octobre 1985. L'organisation soutient le mouvement du logiciel libre et privilégie les logiciels distribués sous des conditions de copyleft (« partage à l'identique »), comme c'est le cas avec sa propre Licence publique générale GNU. La FSF a été constituée à Boston, où elle a également son siège.


Richard Matthew Stallman, également connu sous ses initiales, rms, est un militant américain du mouvement pour le logiciel libre et un programmeur. Il milite pour que les logiciels soient distribués de manière à ce que leurs utilisateurs aient la liberté de les utiliser, de les étudier, de les distribuer et de les modifier. Les logiciels qui garantissent ces libertés sont appelés « logiciels libres ». Stallman a lancé le projet GNU, fondé la Free Software Foundation (FSF) en octobre 1985, développé le compilateur GNU C et GNU Emacs, et rédigé toutes les versions de la licence publique générale GNU. Le livre intitulé « Free as in Freedom : Richard Stallman's Crusade for Free Software » (« Libre comme Liberté : la croisade de Richard Stallman pour les logiciels libres »), publié en 2002, est consacré à la vie de Richard Stallman.

Le 13 mars dernier, la FSF a publié sur son site un communiqué indiquant qu'elle avait reçu une notification concernant un accord à l'amiable dans le cadre du procès pour violation du droit d'auteur opposant Bartz à Anthropic. Ce procès porte sur l'utilisation de bases de données de livres piratés pour entraîner de grands modèles de langage. Selon Krzysztof Siewicz, responsable des licences et de la conformité à la FSF, l'organisation engage rarement des poursuites en matière de droits d'auteur, mais lorsqu'elle le fait, son objectif est de défendre la liberté des utilisateurs plutôt que d'obtenir des dommages-intérêts.

Le communiqué de la FSF est présenté ci-dessous : «

La Free Software Foundation (FSF), comme beaucoup d’autres, a reçu une notification concernant un accord à l’amiable dans le cadre du procès pour violation du droit d’auteur Bartz c. Anthropic. Il s’agit d’un recours collectif alléguant qu’Anthropic a violé le droit d’auteur en téléchargeant des œuvres issues des ensembles de données Library Genesis et Pirate Library Mirror dans le but d’entraîner des grands modèles de langage (LLM). Selon cette notification, le tribunal de district a jugé que l'utilisation des livres pour entraîner des LLM relevait du fair use, mais a renvoyé au procès la question de savoir si leur téléchargement à cette fin était légal. Apparemment, les parties ont convenu de conclure un accord à l'amiable plutôt que d'attendre le procès et elles contactent actuellement les détenteurs potentiels de droits d'auteur pour leur proposer une compensation financière en lieu et place d'éventuels dommages-intérêts.

La FSF détient les droits d'auteur de nombreux programmes du projet GNU, ainsi que de plusieurs ouvrages. Nous publions toutes les œuvres dont nous détenons les droits d'auteur sous des licences libres (au sens de liberté). Parmi les œuvres dont nous détenons les droits d'auteur figure « Free as in freedom : Richard Stallman's crusade for free software » de Sam Williams, qui figurait dans les ensembles de données utilisés par Anthropic comme données d'entraînement pour ses modèles de langage (LLM). Cet ouvrage a été publié par O'Reilly et par la FSF sous la licence GNU Free Documentation License (GNU FDL). Il s'agit d'une licence libre autorisant l'utilisation de l'œuvre à toutes fins sans contrepartie financière.

Il va sans dire que la bonne chose à faire est de protéger la liberté informatique : partager l'intégralité des données d'entraînement avec chaque utilisateur du LLM, ainsi que le modèle complet, les paramètres de configuration de l'entraînement et le code source des logiciels associés. C'est pourquoi nous exhortons Anthropic et les autres développeurs de LLM qui entraînent leurs modèles à l'aide d'énormes ensembles de données téléchargés sur Internet à fournir ces LLM à leurs utilisateurs en toute liberté. Nous sommes une petite organisation aux ressources limitées et nous devons choisir nos combats, mais si la FSF devait participer à un procès tel que Bartz c. Anthropic et constater que nos droits d'auteur et notre licence ont été violés, nous demanderions certainement la liberté des utilisateurs à titre de compensation.

»

Cette affaire s’inscrit dans une série de procédures judiciaires opposant les développeurs d’IA aux détenteurs de droits d’auteur. En août 2025, l'entreprise Anthropic a ainsi accepté de régler le recours collectif pour violation du droit d'auteur dans lequel des auteurs accusaient l'entreprise d'avoir entraîné ses modèles d'IA à partir de leurs œuvres sans leur autorisation. La plainte, déposée en août 2024 par les auteurs Andrea Bartz, Charles Graeber et Kirk Wallace Johnson, contestait l'utilisation de livres protégés pour entraîner le système Claude.

En juin 2025, le juge fédéral William Alsup avait toutefois jugé que l'apprentissage des modèles d'IA à partir d'œuvres protégées pouvait relever de l'« usage loyal », estimant que cette utilisation était « extrêmement transformative » et donc juridiquement défendable, même si le téléchargement initial de certaines sources pouvait constituer une infraction. Les parties ont ensuite demandé à la cour d'appel du neuvième circuit de suspendre la procédure afin de finaliser un accord de règlement présenté par les avocats des auteurs comme potentiellement bénéfique pour l'ensemble du groupe concerné.

Source : Free Software Foundation

Et vous ?

Quel est votre avis sur le sujet ?
Trouvez-vous cette initiative de la FSF crédible ou pertinente ?

Voir aussi :

Anthropic a acheté, découpé et numérisé des millions de livres physiques avant de détruire les originaux, dans le seul but d'entraîner son IA Claude, il a également téléchargé 7 millions de livres piratés

Un juge rejette l'accord à 1,5 milliard de dollars conclu par Anthropic concernant un recours collectif sur les droits d'auteur de près d'un demi-million de livres piratés pour former des chatbots

Anthropic a accepté de verser 1,5 milliard de $ pour régler un procès pour vol d'œuvres protégées par le droit d'auteur afin d'entraîner ses modèles d'IA, le plus important recouvrement de droits d'auteur
Vous avez lu gratuitement 2 681 articles depuis plus d'un an.
Soutenez le club developpez.com en souscrivant un abonnement pour que nous puissions continuer à vous proposer des publications.

Une erreur dans cette actualité ? Signalez-nous-la !

Avatar de kain_tn
Expert éminent https://www.developpez.com
Le 14/08/2026 à 21:04
Citation Envoyé par Mathis Lucas Voir le message
Que pensez-vous de la destruction de livres par les entreprises d'IA ?
A risque de prendre un point Godwin, je ne vois pas bien la différence entre ce qu'ils font et ces heures sombres de l'histoire où l'on brûlait des livres... Le résultat est le même: empêcher la masse d'y avoir accès.
10  0 
Avatar de abgech
Membre actif https://www.developpez.com
Le 19/08/2026 à 9:49
Le patrimoine, ils n'ont n'en rien à foutre.

L'important, c'est d'amasser le plus de fric possible le plus vite possible. Quelle vie exaltante que d'avoir pour but d'être le plus riche du cimetière ! Il est vrai que ces clowns se croient immortels.

Mais ces quelques malades mentaux remettent en question la viabilité sur Terre de la plupart des mammifères, dont Homo sapiens. Pas grave pour la vie en général, les scorpions résistent bien à des conditions sévères et la tardigrades supportent avec aisance des conditions extrêmes.
Si dans quelques dizaines de millions d'années des espèces intelligentes de scorpions ou de tardigrades existent, espérons qu'ils ne feront pas les mêmes conneries qu'Homo sapiens.

Je dois dire qu'à 84 ans, n'ayant pas d'autre descendance qu'un fils de 55 ans, qui lui n'a pas d'enfant, ma seule ambition, c'est que nous puissions vivre jusqu'à la fin, ma compagne, moi et mon fils dans des conditions acceptables.
7  0 
Avatar de totozor
Expert confirmé https://www.developpez.com
Le 23/07/2026 à 7:39
Bientôt la branche scientifique d'Anthropic, en manque de sources, va scanner les livres pour enfants.
Ils découvriront ensuite un optimum génétique dans l'anthropomorphisme, essentiellement pour les formes des animaux de compagnies.
Musk lancera un grand projet pour tous nous transformer un lapins crétins bipèdes.

Non, l'IA ne pousse pas l'humanité à la médiocrité...
Imaginez, on essaye de nous vendre l'AGI (à la fois apocalypse et sauveur), pourtant on a mis tout le savoir du monde dans nos IA qui sont toujours bien loin de leur forme ultime.
Mais bon quoi d'étonnant quand un des leaders du domaine vient d'un pays où la logique a toujours été d'évoluer en augmentant systématiquement la consommation. Et qui ne s'est jamais posé la question de la qualité de ce qu'elle consomme et de sa façon de la consommer.
5  0 
Avatar de Anselme45
Membre extrêmement actif https://www.developpez.com
Le 23/07/2026 à 10:53
A quand le rachat des grottes de Lascaux et des temples égyptiens?
5  0 
Avatar de Anselme45
Membre extrêmement actif https://www.developpez.com
Le 15/08/2026 à 10:48
Citation Envoyé par kain_tn Voir le message
A risque de prendre un point Godwin, je ne vois pas bien la différence entre ce qu'ils font et ces heures sombres de l'histoire où l'on brûlait des livres... Le résultat est le même: empêcher la masse d'y avoir accès.
Il y a pire, c'est l'effacement à long terme du savoir humain!

Tacite, Virgile, Cicéron, autant d'auteurs romains dont les oeuvres nous sont partiellement parvenues après plus de 2 000 ans d'histoire et cela par une transmission de l'écrit via le papier et le livre.

Nous détruisons donc aujourd'hui le livre pour le remplacer par des supports numériques dont AUCUN n'a une durée de vie au-delà d'une décennie:

  • Disque dur (HDD) : 3 à 5 ans en utilisation continue (jusqu'à 10 ans si stocké hors tension)
  • Disque SSD : 5 à 10 ans selon l'écriture des données et l'usure des puces
  • Clé USB et carte mémoire : 5 à 10 ans (la mémoire flash garde mal les charges électriques sur de très longues périodes sans alimentation).
  • CD-R / DVD-R gravés : 2 à 10 ans selon la qualité de la gravure et l'exposition au soleil.
  • Disques pressés du commerce (CD/DVD/Blu-ray audio ou vidéo) : 10 à 30 ans ou plus si manipulés sans rayures


Et là, les "neuneux" vont nous dire "mais on recopie les données sur de nouveaux supports" mais est-ce que les "neuneux" en question croient que les 1 000 ou 2 000 prochaines années se feront sans guerre, sans destruction, sans catastrophes climatiques... Est-ce que ce sont les Musk, Altman et leur descendants qui vont assurer le service après-vente de leur conneries pour les prochains millénaires?

Quelles traces vont laisser dans l'histoire les GAFAM? Aucune!

Quel savoir transmettrons-nous à nos successeurs dans 1 000 ou 2 000 ans? Rien!

Notre civilisation de haute technologie, si avancée, n'est pas prête à concurrencer l'Egypte des pharaons qui nous ont transmis leur vécu après plus de 4 000 ans ou même ceux que l'on nomme encore "les hommes des cavernes" qui eux ont laissé leur trace plusieurs milliers d'années après avoir peint les parois de grottes
5  0 
Avatar de _toma_
Membre éclairé https://www.developpez.com
Le 17/03/2026 à 8:40
Le procès pour atteinte au copyright n'est pas mené par Stallman :
Pour rappel, en juillet 2025, un juge fédéral de Californie a autorisé trois auteurs (Andrea Bartz, Charles Graeber et Kirk Wallace Johnson) à mener une action collective nationale contre la start-up Anthropic
Bien que le tribunal ait jugé l'utilisation des livres équitable, la FSF demande aux développeurs d'intelligence artificielle (IA) qui entraînent leurs modèles à l'aide d'énormes ensembles de données téléchargés sur Internet de fournir les LLM à leurs utilisateurs en toute liberté, à titre de compensation.
3  0 
Avatar de OrthodoxWindows
Membre expert https://www.developpez.com
Le 17/03/2026 à 19:25
Citation Envoyé par Access_to_folder Voir le message
Et donc si j'ai bien suivi, le livre piraté non libre de M. Stallman mais diffusé par FSF en licence libre si pas d'usage commercial, la FSF envisagerait la possibilité d'un procès faisant que vu que Anthropic a utilisé d'une licence libre, le LLM d'Anthropic doit devenir libre en tant que dommage de réparation à cette violation de droits et acceptation de fait, par usage en traitement automatisé, d'un bien en licence libre...
Ce qui est logique, car, comme vous l'avez dit vous-même, ce livre est placé en "en licence libre si pas d'usage commercial". Hors Anthropic, en l'utilisant pour un LLM commercial, viole potentiellement cette licence.
Après, le débat de fond porte, comme toujours, sur si pour un LLM, ça va être plus de l'inspiration, ou plus du plagiat. Mais la logique de la FSF se tient si l'on en reste à ce qu'elle demande (le passage des LLM d'Anthropic concernés en non-commercial)
3  0 
Avatar de OuftiBoy
Membre éprouvé https://www.developpez.com
Le 15/08/2026 à 17:09
C'est pour cela que quelle soit l'issue, l'IA n'est pas une bonne chose.

Soit c'est "magique" et au final l'homme n'aura plus besoin d'apprendre (sauf une élite bien sélectionnée pourra/devra/saura cultiver l'innovation et la recherche humaine) -> décébération des masses.

Soit ça se termine en eau de boudin, et là encore, qui va trinquer ?

Mais c'est rien d'étonnant, cela a toujours fonctionner ainsi de tout temps. Les civilisations évoluent, atteignent un point culminant, puis s'effondrent.
2  0 
Avatar de _toma_
Membre éclairé https://www.developpez.com
Le 17/03/2026 à 9:00
Ha oui j'avais pas vu.
1  0 
Avatar de totozor
Expert confirmé https://www.developpez.com
Le 18/08/2026 à 8:00
Citation Envoyé par OuftiBoy Voir le message
Soit c'est "magique" et au final l'homme n'aura plus besoin d'apprendre (sauf une élite bien sélectionnée pourra/devra/saura cultiver l'innovation et la recherche humaine) -> décébération des masses.
Soit ça se termine en eau de boudin, et là encore, qui va trinquer ?
Je ne vois pas en quoi la première hypothèse n'est pas contenue dans la deuxième.
Qui dans l'élite va se charger d'innover une fois qu'ils seront dans leur tour d'ivoire?
Innover avec quel savoir?
Celui que leur fournit l'IA? Qui sera la seule encyclopédie existante.
Savoir qui sera tantôt réel tantôt une hallucination.
Les plus malins arrêteront d'essayer d'apprendre à voler après que 10 personnes aient tenté un saut de la foi avec une technologie issue de l'IA.
La mort de l'évolution.
La mort de l'humain.
Dans ces conditions un si mauvaise nouvelle?
0  0