Generatiivsete AI mudelite avatushinnang

Nijmegen ülikooli teadlased (Holland) on koostanud 40 suure keelemudeli ja 7 pildi genereerimise mudeli, mis on tootjate poolt avatud, avatusjärjestiku. Kuna masinõppe mudelite avatuskriteeriumid on alles kujunemas, on praeguseks tekkinud olukord, kus avatud mudelite nime all levitatakse mudeleid, millel on kasutusala piirev litsents (nt paljud mudelid keelavad kasutamise kaubanduslikes projektides). Samuti ei paku tootjad sageli ligipääsu koolituse käigus kasutatud andmetele, ei avalikusta rakenduse üksikasju ega ava täielikult seotud koodi.

Enamik mudeleid, mida positsioneeritakse kui "avatud", tuleks pigem tõlgendada kui "avatud kaalud" või täpsemalt "ligipääsetavad kaalud", kuna need levitatakse piiravate litsentside alusel, mis keelavad kasutamise kaubanduslikes toodetes. Kolmandad teadlased saavad katsetada selliseid mudeleid, kuid ei saa kohandada mudelit oma vajadustele ega uurida rakendust. Üle poole mudelitest ei paku detailset teavet koolituse käigus kasutatud andmete kohta ja ei avalikusta teavet sisemise struktuuri ja arhitektuuri kohta.

Kõige avatumateks tunnistatakse mudeleid BloomZ, AmberChat, OLMo, Open Assistant ja Stable Diffusion, mis on avaldatud avatud litsentside alusel koos algandmete, koodi ja API rakendusega. Google'i mudelid (Gemma 7B), Microsofti mudel (Orca 2) ja Meta mudel (Llama 3), mida tootjad positsioneerivad avatud, on reitingu lõpus, kuna need ei paku ligipääsu algandmetele, ei avalikusta tehnilisi üksikasju ning mudeli kaalusid jagatakse litsentside all, mis piiravad kasutusala. Populaarne mudel Mistral 7B jäi reitingu keskele, kuna see on saadaval avatud litsentsi all, kuid on vaid osaliselt dokumenteeritud, ei avalikusta koolituse käigus kasutatud andmeid ja selle kaasne kood ei ole täiesti avatud.

Teadlased on välja pakkunud 14 AI mudelite avatuskriteeriumi, mis katab koodi, koolitusandmete, kaalude, andmevariantide ja RL-õppe põhjal optimeeritud kaalude levitamise tingimused, samuti kasutusvalmis pakettide, API, dokumentatsiooni ja rakenduse üksikasjaliku kirjelduse olemasolu.

Generatiivsete AI mudelite avatushinnang

Generatiivsete AI mudelite avatushinnang

OSi (Open Source Initiative) esitatud avatud AI mustandi määratlemise kohaselt on peamised AI süsteemi avatuskriteeriumid võimaluste pakkumine kasutamiseks mis tahes eesmärkidel ilma eraldi loa saamise vajaduseta; süsteemi töö uurimise ja selle koostisosade kontrollimise võimalus; muudatuste tegemise võimalus mis tahes eesmärkidel; teistele isikutele edastamine nii algse variandi kui ka muudetud redaktsiooni kujul.

Muudatuste tegemise võimaldamiseks peab AI-süsteem hõlmama:

  • Üksikasjalikku teavet andmete kohta, mida on kasutatud treenimisel, ning treenimise metodoloogia. Teavet peab olema piisavalt, et professionaalne arendaja saaks iseseisvalt rekonstrueerida vastava AI-süsteemi, kasutades treenimiseks samu või sarnaseid andmeid.
  • Algkoodi olemasolu, mis võimaldab käivitada AI-süsteemi ja läbi viia selle koolitusprotsessi (ülevaatetabelis, kus paljude mudelite koodi veerus on märgitud "~", mis viitab osalisele koodi olemasolule, kus on olemas mudeli käivitamise kood, kuid puudub koolitus- või mudeli loomise kood). Kood peab katma ka selliseid valdkondi nagu eeltöötlus, andmete kontrollimine ja tokeniseerimine. Lisaks peab olema esitatud mudeli arhitektuuri detailne kirjeldus.
  • Mudeli parameetrid (kaalud), mis viitavad sellele, et olemas on kasutamiseks valmis olek pärast koolitamist või lõpliku optimeeritud versiooni olemasolu.

Allikas: opennet.ru

Osta usaldusväärne veebihosting DDoS kaitsega, VPS VDS serverid 🔥 Osta usaldusväärne veebihosting DDoS kaitsega, VPS VDS serverid | ProHoster