El consejo de administración de la distribución Gentoo Linux ha aprobado reglas que prohíben la aceptación de cualquier contenido en Gentoo creado con herramientas de IA que procesan solicitudes de lenguaje natural, como ChatGPT, Bard y GitHub Copilot. Estas herramientas no deben utilizarse al escribir el código de los componentes de Gentoo, crear ebuilds, preparar documentación y enviar informes de errores.
Las principales preocupaciones por las que se prohíbe el uso de herramientas de IA en Gentoo:
- La incertidumbre en torno a la posible violación de derechos de autor en el contenido creado mediante modelos entrenados en un gran conjunto de información, que incluye obras protegidas por derechos de autor. También se menciona la imposibilidad de garantizar el cumplimiento de los requisitos de licencia en el código generado a través de herramientas de IA. El código generado por IA puede considerarse como la creación de una obra derivada del código utilizado para entrenar el modelo y que se distribuye bajo ciertas licencias.
Por ejemplo, al entrenar un modelo con código bajo una licencia que requiere atribución, el requisito no se cumple en el código proporcionado por las herramientas de IA, lo que puede considerarse una violación de la mayoría de las licencias abiertas, como GPL, MIT y Apache. También pueden surgir problemas de compatibilidad de licencias al insertar en proyectos bajo licencias permisivas código generado utilizando modelos entrenados en código con licencias copyleft.
- Posibles problemas de calidad. Las preocupaciones están relacionadas con el hecho de que el código o el texto generado por herramientas de IA pueden parecer correctos, pero contener problemas implícitos y discrepancias con los hechos. Utilizar tal contenido sin verificación puede llevar a una disminución de la calidad de los proyectos. Por ejemplo, el código sintetizado puede repetir errores del código utilizado para entrenar el modelo, lo que finalmente puede dar lugar a vulnerabilidades y a la falta de comprobaciones necesarias al procesar datos externos.
La verificación requiere un gran esfuerzo en la verificación de hechos y la revisión del código. Al analizar informes de errores generados automáticamente, los desarrolladores se ven obligados a perder mucho tiempo en el análisis de informes innecesarios y a verificar la información mencionada varias veces, ya que la calidad externa del formato genera confianza en la información y da la impresión de que el revisor no entendió algo.
- Cuestiones éticas relacionadas con la violación de derechos de autor al entrenar modelos, el impacto negativo en el medio ambiente debido a los altos costos energéticos en la creación de modelos, despidos derivados de la sustitución del personal por servicios de IA, la reducción de la calidad de los servicios tras reemplazar el soporte con bots, y la expansión de las oportunidades para el spam y el fraude.
En el anuncio se menciona que el nuevo requisito puede ser anulado de manera selectiva para las herramientas de IA para las cuales se demuestre la ausencia de problemas relacionados con derechos de autor, calidad y ética.
Fuente: opennet.ru
