Google avas AI mudeli Gemma, mis põhineb tehnoloogiatel, mis on jagatud juturoboti Gemini'ga

Google väljendas suurt keelemudeli masinõppe mudelit Gemma, mis on loodud tehnoloogiate abil, mida kasutatakse vestlusrobotite mudeli Gemini loomiseks, püüdes konkureerida ChatGPT-ga. Mudel on saadaval neljas variandis, hõlmates 2 ja 7 miljardit parameetrit, põhiversioonis ja dialooge süsteemide jaoks optimeeritud variandis. 2 miljardit parameetrit sisaldavad variandid sobivad tarbijarakendustes kasutamiseks ning nende töötluseks piisab CPU-st. 7 miljardi parameetriga variandid nõuavad võimsamat riistvara koos GPU või TPU olemasoluga.

Gemma mudeli rakenduste seas on välja toodud dialoogisüsteemide ja virtuaalsete assistentide loomine, teksti genereerimine, vastuste kujundamine loomuliku keele küsimustele, kokkuvõtete ja üldistuste tegemine, kontseptsioonide ja terminite sisulise tähenduse selgitamine, tekstivigade parandamine, keeleõppe toetamine. Toetatakse erinevat tüüpi tekstide genereerimist, sealhulgas luuletusi, programmeerimiskeeles kirjutatud koodi, teoste ümberkirjutamist teiste sõnadega ja шаблоonide põhjal kirjade koostamist. Samas on mudel suhteliselt väike, võimaldades seda kasutada oma riistvaral, millel on piiratud ressursid, näiteks tavalistes sülearvutites ja lauaarvutites.

Mudeli litsents lubab tasuta kasutamist ja levitamist mitte ainult teaduslikes ja isiklikes projektides, vaid ka kommertsproduktides. Samuti on lubatud muudetud versioonide loomine ja avaldamine. Kasutustingimustes on keelatud mudeli kasutamine pahatahtlikeks tegevusteks ning ettenähtud on, et oma toodetes tuleks kasutada viimast versiooni Gemma.

Gemma mudelitega töö toetamine on juba lisatud tööriistade komplekti Transformers ja Responsible Generative AI Toolkit. Mudeli optimeerimiseks saab kasutada Keras raamistikku ning TensorFlow, JAX ja PyTorch tagapõhju. Samuti on tagatud Gemma kasutamise võimalus MaxText, NVIDIA NeMo ja TensorRT-LLM raamistikuga.

Gemma mudeli konteksti on 8000 tokenit (tokenite arv, mida mudel suudab töödelda ja meeles pidada teksti genereerimisel). Võrdluseks, Gemini ja GPT-4 mudelite konteksti suurus on 32000 tokenit, samas kui GPT-4 Turbo mudel suudab käsitleda 128000 tokenit. Mudel toetab ainult inglise keelt. Suutlikkuse poolest jääb Gemma-7B mudel LLama 2 70B Chat mudelist veidi maha, kuid ületab pisut DeciLM-7B, PHI-2 (2.7B) ja Mistral-7B mudeleid. Google'i mudel Gemma-7B ületab veidi LLama 2 7B/13B ja Mistral-7B.

Google avas AI mudeli Gemma, mis põhineb tehnoloogiatel, mis on jagatud juturoboti Gemini'ga


Allikas: opennet.ru
Osta usaldusväärne hostimine veebilehtede jaoks DDoS-i kaitsega, VPS VDS serverid 🔥 Osta usaldusväärne hostimine veebilehtede jaoks DDoS-i kaitsega, VPS VDS serverid | ProHoster