Consiliul de management al distribuției Gentoo Linux a aprobat reguli care interzic acceptarea în Gentoo a oricărui conținut creat cu ajutorul instrumentelor AI care procesează solicitări în limbaj natural, cum ar fi ChatGPT, Bard și GitHub Copilot. Astfel de instrumente nu ar trebui să fie utilizate în scrierea codului componentelor Gentoo, crearea ebuild-urilor, pregătirea documentației și trimiterea rapoartelor de erori.
Principalele preocupări care duc la interzicerea utilizării instrumentelor AI în Gentoo:
- Incertitudinea cu privire la posibila încălcare a drepturilor de autor în conținutul creat cu ajutorul modelelor antrenate pe un volum mare de informații, care include și lucrări protejate prin drepturi de autor. De asemenea, se menționează imposibilitatea de a garanta respectarea cerințelor de licențiere în codul generat prin instrumente AI. Codul generat de AI poate fi considerat ca o lucrare derivată a codului care a fost utilizat pentru antrenarea modelului și este distribuit sub anumite licențe.
De exemplu, atunci când un model este antrenat pe cod cu o licență care necesită notificarea autorului (atribuire), în codul furnizat de instrumentele AI această cerință nu este respectată, ceea ce poate fi văzut ca o încălcare a majorității licențelor deschise, cum ar fi GPL, MIT și Apache. De asemenea, pot apărea probleme de compatibilitate a licențelor atunci când se integrează în proiecte sub licențe permisive cod generat folosind modele antrenate pe cod cu licențe copyleft.
- Probleme posibile cu calitatea. Preocupările sunt legate de faptul că codul sau textul generat de instrumentele AI poate părea corect, dar poate conține probleme implicite și discrepanțe față de fapte. Utilizarea unui astfel de conținut fără verificare poate duce la o scădere a calității proiectelor. De exemplu, codul sintetizat poate repeta erorile codului utilizat pentru antrenarea modelului, ceea ce va duce în final la apariția vulnerabilităților și la lipsa verificărilor necesare pentru procesarea datelor externe.
Verificarea necesită resurse mari pentru verificarea faptelor și recenzarea codului. Analizând rapoartele de erori generate automat, dezvoltatorii sunt nevoiți să piardă mult timp analizând rapoarte inutile și să verifice informațiile prezentate de mai multe ori, deoarece calitatea exterioară a prezentării generează încredere în informație și creează impresia că cel care recenzează nu a înțeles ceva.
- Întrebările etice legate de încălcarea drepturilor de autor în timpul antrenării modelelor, impactul negativ asupra ecologiei din cauza consumului mare de energie în crearea modelelor, concedierile cauzate de înlocuirea personalului cu servicii AI, scăderea calității serviciilor după înlocuirea asistenței cu roboți, și extinderea oportunităților pentru spam și fraudă.
În anunț se menționează că noua cerință poate fi anulată selectiv pentru instrumentele AI pentru care se va dovedi absența problemelor legate de drepturile de autor, calitate și etică.
Sursa: opennet.ro
