Réécriture du code par l'IA pour le changement de licence des projets open source

Dan Blanchard, développeur de la bibliothèque chardet pour la détection des encodages en Python, a publié une nouvelle version de la bibliothèque sous une nouvelle licence. La version 7.0 utilise la licence MIT au lieu de la licence LGPL. Le développeur affirme que l'assistant AI Anthropic Claude, qui figure désormais parmi les contributeurs, a réécrit la bibliothèque sans utiliser de code original, ce qui lui a permis de remplacer la licence copyleft par une licence permissive.

Un utilisateur, se présentant comme Mark Pilgrim, l'un des créateurs initiaux de la bibliothèque (malheureusement, le compte de cet utilisateur est vide et il est impossible de vérifier s'il est bien celui qu'il prétend être), a rejoint la discussion sur cette action et a créé un problème, affirmant que Dan n'avait pas le droit de modifier la licence du projet.

Dan a répondu qu'il avait comparé les versions 7.0.0 et 6.0.0 à l'aide d'une bibliothèque de détection de plagiat, et la similarité entre les versions était inférieure à 1,3 %. Selon lui, aucun fichier de la base de code de la version 7.0.0 n'est similaire en structure à un fichier de précédents versions.

Dan a expliqué qu'il souhaitait que la bibliothèque chardet soit intégrée dans la bibliothèque standard de Python, car elle est une dépendance clé pour de nombreux projets en Python. Mais trois obstacles - la licence, la vitesse et la précision - ont empêché cette intégration. Grâce aux travaux réalisés, la vitesse de détection des encodages par la bibliothèque a été multipliée par 48. Pour un projet qui est activement utilisé dans de nombreux autres projets, cette optimisation entraînera une amélioration notable des performances pour des millions d'utilisateurs (le paquet est téléchargé environ 130 millions de fois par mois).

Zoé Koiman, directrice exécutive de la Free Software Foundation, a déclaré au média The Register : « Nous ne pouvons pas commenter les détails spécifiques ou la légalité de ce projet sans conduire des recherches supplémentaires ou consulter des avocats, mais il n'y a rien de « pur » à ce qu'un grand modèle de langage (LLM) utilise du code qu'on lui demande de réécrire ».

Zoe a décidé de porter un jugement moral sur l'acte de Dan : « En ce qui concerne le sens de la GPL, une licence permissive est techniquement encore une licence de logiciel libre, mais saper le copyleft est un acte sérieux. Refuser de fournir aux autres des droits que vous avez vous-même en tant qu'utilisateur est extrêmement antisocial, peu importe la méthode utilisée. »

Bruce Perens, l'auteur de la définition originale du code source ouvert, a exprimé son inquiétude quant à la situation actuelle : « Les changements sociaux à venir sont d'une ampleur similaire, et, comme nous le voyons déjà, encore plus préoccupants. »

Les conséquences juridiques de l'utilisation d'un grand modèle de langage pour retravailler à la fois des projets ouverts et propriétaires (dont le code source a été volé) sont difficiles à prédire et dépendent fortement des précédents établis par les tribunaux. Cependant, si un grand modèle de langage réécrit du code dans un langage de programmation différent de l'original, il devient pratiquement impossible de prouver la création d'une œuvre dérivée.

Récemment, la Cour Suprême des États-Unis a refusé de réexaminer l'affaire « Thaler contre Perlmutter », dans laquelle le plaignant tentait d'annuler la décision d'un tribunal inférieur selon laquelle il ne pouvait pas protéger par le droit d'auteur une image créée par une intelligence artificielle. La Cour Suprême des États-Unis a maintenu la décision du tribunal de première instance selon laquelle les œuvres entièrement créées par l'IA ne sont pas protégées par le droit d'auteur.

Source : opennet.ru

Acheter un hébergement fiable pour les sites avec protection DDoS, serveurs VPS VDS 🔥 Acheter un hébergement fiable pour les sites avec protection DDoS, serveurs VPS VDS | ProHoster