Google ka hapur modelin AI Gemma, i bazuar në teknologjitë e përbashkëta me chatbot-in Gemini

Kompania Google shpalli publikimin e një modeli të madh gjuhësor të mësimit të makinerisë, Gemma, i ndërtuar duke përdorur teknologjitë e aplikuara për ndërtimin e modelit të chatbot-it Gemini, që përpiqet të konkurrojë me ChatGPT. Modeli është i disponueshëm në katër variante, duke mbuluar 2 dhe 7 miliard parametra, në formatin bazë dhe të optimizuar për sistemet e dialogut. Variantet me 2 miliard parametra janë të përshtatshme për përdorim në aplikacione për konsumatorët dhe për përpunimin e tyre është i mjaftueshëm CPU. Variantet me 7 miliard parametra kërkojnë pajisje më të fuqishme dhe një GPU ose TPU.

Në mesin e fushave të përdorimit të modelit Gemma përmendet krijimi i sistemeve të dialogut dhe asistentëve virtualë, gjenerimi i tekstit, formimi i përgjigjeve për pyetje të bëra në gjuhë të natyrshme, përmbledhja dhe përmbledhja e përmbajtjes, shpjegimi i esencës së koncepteve dhe terminologjisë, korrigjimi i gabimeve në tekst, ndihma në mësimin e gjuhëve. Përkrah krijimin e llojeve të ndryshme të të dhënave tekstuale, duke përfshirë poezi, kod në gjuhët e programimit, rishkrimin e veprave me fjalë të tjera, formimin e letrave sipas një modeli. Në të njëjtën kohë, modeli ka një madhësi relativisht të vogël, që lejon përdorimin e tij në pajisje me burime të kufizuara, siç janë laptopët dhe PC-të e zakonshëm.

Licenca për modelin lejon përdorimin dhe shpërndarjen falas jo vetëm në projekte hulumtuese dhe personale, por edhe në produkte komerciale. Njëkohësisht, lejohet krijimi dhe publikimi i varianteve të modifikuara të modelit. Megjithatë, kushtet e përdorimit ndalojnë përdorimin e modelit për kryerjen e veprimeve të dëmshme dhe parashikojnë që, sa më shumë të jetë e mundur, të përdoret versioni më i fundit i Gemma në produktet e tij.

Mbështetje për punën me modelet Gemma është shtuar tashmë në setin e mjeteve Transformers dhe në Responsible Generative AI Toolkit. Për optimizimin e modelit mund të përdoret framework-u Keras dhe backend-et për TensorFlow, JAX dhe PyTorch. gjithashtu është siguruar mundësia e përdorimit të Gemma me framework-e si MaxText, NVIDIA NeMo dhe TensorRT-LLM.

Madhësia e kontekstit që modelin Gemma e merr parasysh është 8 mijë tokenë (numri i tokenëve që modeli mund të përpunojë dhe të mbajë mend gjatë gjenerimit të tekstit). Për krahasim, madhësia e kontekstit për modelet Gemini dhe GPT-4 është 32 mijë tokenë, ndërsa për modelin GPT-4 Turbo — 128 mijë. Ky model mbështet vetëm gjuhën angleze. Në performancë, modeli Gemma-7B është paksa më i dobët se modeli LLama 2 70B Chat dhe paksa më i përparuar se modelet DeciLM-7B, PHI-2 (2.7B) dhe Mistral-7B-v0.1. Në krahasim me Google, modeli Gemma-7B është paksa më i përparuar se LLama 2 7B/13B dhe Mistral-7B.

Google ka hapur modelin AI Gemma, i bazuar në teknologjitë e përbashkëta me chatbot-in Gemini


Burimi: opennet.ru
Blini hosting të besueshëm për faqe interneti me mbrojtje nga DDoS, serverë VPS VDS 🔥 Blini hosting të besueshëm për faqe interneti me mbrojtje nga DDoS, serverë VPS VDS | ProHoster