Bradley M. Kuhn, director executiv și unul dintre fondatorii organizației de apărare Software Freedom Conservancy (SFC), și-a exprimat critica față de definiția sistemului AI deschis (Open Source AI) recent publicată de organizația OSI (Open Source Initiative). În opinia lui Kuhn, organizația OSI a grăbit publicarea versiunii finale a definiției, aprobând-o fără o discuție amplă și detaliată în etapa inițială de dezvoltare a unor astfel de sisteme. Spre deosebire de aceasta, definiția Open Source a fost formulată după mulți ani de reflecții și discuții. Referitor la definiția publicată a sistemului AI deschis, în această etapă, ar fi trebuit să fie denumită nu definiție, ci recomandare.
Kuhn se teme că criteriile acceptate în forma actuală pentru AI deschis vor avea consecințe de amploare, vor submina autoritatea termenului Open Source și vor duce la divizarea comunității. Problema este că, în ciuda obiecțiilor, organizația OSI a făcut un compromis și nu a inclus cerința de a furniza datele utilizate pentru antrenarea modelului. Cauza compromisului a fost că, dacă ar fi fost adăugat un astfel de punct, niciunul dintre modelele mari existente de limbaj nu ar fi obținut statutul de deschis.
În opinia OSI, formularea definiției sistemului AI deschis, care să țină cont de realitățile existente, va împiedica manipularea termenului „deschis” de către producători, care în condiții de incertitudine numesc deschise modelele doar pe baza disponibilității coeficientului, chiar dacă licența modelului limitează domeniul de utilizare (de exemplu, multe modele interzic utilizarea în proiecte comerciale) și nu se dezvăluie detalii de implementare.
În definiția aprobată de OSI a sistemului AI deschis, se cere doar furnizarea de informații detaliate despre datele utilizate pentru antrenare, dar nu și datele în sine. Fără furnizarea datelor brute pe care modelul a fost antrenat, nu este posibilă reproducerea completă a sistemului AI, ceea ce contrazice conceptul de cod sursă deschis. Astfel, organizația OSI s-a limitat la a considera modelul AI doar ca o tehnologie și nu ca un produs integrat.
Definiția acceptată pentru sistemele AI deschise oferă în mod garantat doar două dintre cele patru libertăți declarate Open Source — posibilitatea de a folosi și posibilitatea de a distribui, în timp ce oportunitățile de modificare și studiu nu sunt pe deplin asigurate. În plus, lipsa datelor originale îngreunează identificarea substituțiilor de tip backdoor în modelele de învățare automată.
Pe de altă parte, publicarea datelor originale este în multe cazuri imposibilă din motive care nu depind de dezvoltatorul modelului AI, cum ar fi necesitatea de a păstra confidențialitatea, utilizarea materialelor protejate prin drepturi de autor, licențierea datelor de la furnizori terti etc. Potrivit criticilor definiției adoptate, aceste probleme nu constituie un motiv pentru diminuarea și devalorizarea conceptului de Open Source.
Bradley Kun intenționează să participe la următoarele alegeri pentru conducerea OSI și să încerce să intre în consiliul director pentru a obține anularea definiției adoptate și tranformarea acesteia în recomandări. Pe lângă organizația Software Freedom Conservancy, unele dintre dezvoltatorii proiectului Debian și-au exprimat dezacordul față de definiția AI-ului deschis, inițiind un vot comun pentru a atrage atenția asupra problemei. De asemenea, Fundația SSO lucrează la propria definiție a sistemului AI liber, care intenționează să introducă în definiția sa cerința accesibilității tuturor datelor, dar recunoaște existența motivelor etice care împiedică în unele cazuri divulgarea datelor (de exemplu, dacă în timpul antrenării au fost folosite date medicale sau personale).
Sursa: opennet.ro
