Un gruppo di ricercatori dell'Università di Yale ha proposto (PDF) un nuovo tipo di licenze open source CCAI (Contextual Copyleft), che amplia l'applicazione del copyleft ai modelli AI generativi. L'idea alla base del CCAI è che l'uso di contenuti sotto questa licenza come dati per l'apprendimento automatico porta all'estensione delle condizioni del copyleft ai modelli AI generativi risultanti. Si prevede che la nuova licenza possa contribuire a ridurre gli abusi nei progetti AI e a prevenire la creazione di modelli AI fittizi, presentati formalmente come open source, ma collegati al produttore per via della segretezza dei dati di origine e degli strumenti di addestramento.
Il CCAI stabilisce che qualsiasi distribuzione e pubblicazione di copie esatte o opere derivate modificate, distribuite sotto la licenza CCAI, deve avvenire alle medesime condizioni di licenza senza l'imposizione di ulteriori restrizioni. Questa richiesta si applica a qualsiasi modello AI, set di dati o sistema AI, per l'addestramento dei quali è stato utilizzato software sotto licenza CCAI o un risultato del suo lavoro. Nel contesto dell'addestramento dei modelli AI generativi, il CCAI richiede la divulgazione del codice sorgente del modello, una descrizione dettagliata dei dati utilizzati per l'addestramento, dei parametri, dei pesi e dell'architettura del modello.
La licenza CCAI può anche essere utilizzata come requisito aggiuntivo, allegato a licenze copyleft esistenti, come l'AGPLv3. Tale requisito estende l'ambito della licenza ai set di dati di addestramento, al codice e ai coefficienti del modello in conformità con i criteri di apertura dei sistemi AI formulati dall'Open Source Initiative (OSI). Il codice distribuito sotto tale licenza può essere utilizzato per l'addestramento di un modello AI solo a condizione che a tutti gli utenti venga fornita una descrizione del set di dati di addestramento, del codice per l'addestramento del modello e del modello AI addestrato.
Testo dell'ulteriore richiesta allegata: «Nell'uso di software per l'apprendimento, l'ottimizzazione o la creazione di qualsiasi modello di apprendimento automatico o sistema AI generativo, qualsiasi modello, insieme di dati o sistema risultante deve essere pubblicato a condizioni che non inaspriscano i requisiti di questa licenza. Tale richiesta copre la fornitura di accesso al codice per il training, la descrizione dei dati utilizzati durante l'addestramento, le impostazioni e l'architettura del modello. La fornitura di accesso al modello o al risultato del suo funzionamento attraverso la rete è considerata distribuzione e rappresenta la base per l'adempimento degli obblighi imposti dalla licenza».
Fonte: opennet.ru
