Reescritura de código utilizando IA para la relicencia de proyectos de código abierto

Dan Blanchard, desarrollador de la biblioteca chardet para la detección de codificación de caracteres en Python, ha lanzado una nueva versión de la biblioteca bajo una nueva licencia. En la versión 7.0 se utiliza la licencia MIT en lugar de la LGPL. El desarrollador afirma que el asistente de IA Anthropic Claude, que ahora figura en la lista de colaboradores, reescribió la biblioteca sin utilizar el código original, lo que le permitió reemplazar la licencia copyleft por una permisiva.

Un usuario que se identificó como Mark Pilgrim, creador original de la biblioteca (lamentablemente la cuenta de este usuario está vacía y no es posible verificar si es quien dice ser), se unió a la discusión sobre esta acción y creó un issue en el que afirma que Dan no tiene derecho a cambiar la licencia del proyecto.

Dan respondió que comparó las versiones 7.0.0 y 6.0.0 utilizando una biblioteca de detección de plagio y la similitud entre las versiones fue de menos del 1.3%. Según sus palabras, ningún archivo en la base de código de la versión 7.0.0 se parece en estructura a ninguno de los archivos de cualquier versión anterior.

Dan mencionó que deseaba que la biblioteca chardet fuera incluida en la biblioteca estándar de Python, ya que es una dependencia clave para muchos proyectos de Python. Sin embargo, hubo tres obstáculos para la integración: la licencia, la velocidad y la precisión. Como resultado del trabajo realizado, la velocidad de detección de la codificación por parte de la biblioteca se ha incrementado en 48 veces. Para un proyecto que se utiliza activamente en muchos otros proyectos, esta optimización resultará en un aumento notable del rendimiento para millones de usuarios (el paquete se descarga alrededor de 130 millones de veces al mes).

Zoe Coyman, directora ejecutiva de la Fundación de Software Libre, dijo a The Register: «No podemos comentar sobre los detalles específicos o sobre la legalidad de este proyecto sin realizar una investigación adicional o consultar con abogados, pero no hay nada 'limpio' en que un modelo de lenguaje grande (LLM) use código que se le exige reescribir».

Al mismo tiempo, Zoe decidió dar una evaluación moral de la acción de Dan: «En cuanto al sentido de la GPL, una licencia permisiva sigue siendo técnicamente una licencia de software libre, pero socavar el copyleft es un acto serio. Negarse a otorgar a otros los derechos que usted mismo ha recibido como usuario es extremadamente antisocial, independientemente del método utilizado.»

Bruce Perens, autor de la definición original de código abierto, expresó su preocupación por la situación actual: «Los cambios sociales venideros son igualmente grandes y, como ya estamos viendo, aún más aterradores.»

Las consecuencias legales de aplicar un gran modelo de lenguaje para reutilizar tanto proyectos abiertos como propietarios (de los cuales se ha robado el código fuente) son difíciles de predecir y dependen en gran medida de los precedentes establecidos por los tribunales. Sin embargo, si un gran modelo de lenguaje reescribe código en un lenguaje de programación diferente al original, probar la creación de una obra derivada se vuelve prácticamente imposible.

Recientemente, la Corte Suprema de EE. UU. se negó a revisar el caso 'Thaler contra Perlman', en el que el demandante intentó revertir una decisión del tribunal inferior que establecía que no podía proteger con derechos de autor una imagen creada por inteligencia artificial. La Corte Suprema de EE. UU. mantuvo la decisión del tribunal inferior de que las obras creadas completamente por AI no están protegidas por derechos de autor.

Fuente: opennet.ru

Compra un hosting fiable para sitios web con protección contra DDoS, servidores VPS VDS 🔥 Compra un hosting fiable para sitios web con protección contra DDoS, servidores VPS VDS | ProHoster