Google prezantoi modelin e saj kompakt të gjuhës Gemma 2 2B, i cili tejkalon GPT 3.5 Turbo

Kompania Google paraqiti Gemma 2 2B — njĂ« model kompakt, por powerful i gjuhĂ«s sĂ« inteligjencĂ«s artificiale (LLM), i cili mund tĂ« rivalizojĂ« liderĂ«t e industrisĂ«, pavarĂ«sisht nga madhĂ«sia e tij shumĂ« mĂ« e vogĂ«l. Modeli i ri i gjuhĂ«s, me vetĂ«m 2.6 miliard parametra, tregon performancĂ« tĂ« ngjashme me ato shumĂ« mĂ« tĂ« mĂ«dha, duke pĂ«rfshirĂ« OpenAI GPT-3.5 dhe Mistral AI Mixtral 8x7B.

Google prezantoi modelin e saj kompakt të gjuhës Gemma 2 2B, i cili tejkalon GPT 3.5 Turbo

NĂ« testin LMSYS Chatbot Arena, njĂ« platformĂ« online populare pĂ«r testimin e krahasuar dhe vlerĂ«simin e cilĂ«sisĂ« sĂ« modeleve tĂ« inteligjencĂ«s artificiale, Gemma 2 2B ka fituar 1130 pikĂ«. Ky rezultat e kalon pak rezultatin e GPT-3.5-Turbo-0613 (1117 pikĂ«) dhe Mixtral-8x7B (1114 pikĂ«) — modele qĂ« kanĂ« dhjetĂ«fish mĂ« shumĂ« parametra.

Google prezantoi modelin e saj kompakt të gjuhës Gemma 2 2B, i cili tejkalon GPT 3.5 Turbo

Google njofton se Gemma 2 2B gjithashtu ka fituar 56.1 pikë në testin MMLU (Massive Multitask Language Understanding) dhe 36.6 pikë në testin MBPP (Mostly Basic Python Programming), që është një përmirësim të ndjeshëm krahasuar me versionin e mëparshëm.

Gemma 2 2B sfidon besimin e zakonshëm se modelet më të mëdha të gjuhës fillimisht funksionojnë më mirë se ato kompakte. Performanca e Gemma 2 2B tregon se metodat komplekse të mësimit, efektiviteti i arkitekturës dhe datasetet e kualitetit të lartë mund të kompensojnë mungesën në numrin e parameterëve. Zhvillimi i Gemma 2 2B gjithashtu thekson rëndësinë në rritje të metodave të kompresimit dhe distilimit të modeleve të AI. Kapaciteti për të kompiluar informacionin në mënyrë efektive nga modelet më të mëdha në ato më të vogla hap mundësi për krijimin e mjeteve më të arritshme të AI, pa sakrifikuar performancën e tyre.

Google e ka trajnuar Gemma 2 2B në një dataset të madh prej 2 trilion tokenësh, duke përdorur sisteme të bazuara në akceleratorët e saj të markës TPU v5e. Mbështetje për shumë gjuhë zgjeron potencialin e saj për aplikacione globale. Modeli Gemma 2 2B është me kod të hapur. Hulumtuesit dhe zhvilluesit mund të aksesojnë modelin përmes platformës Hugging Face. Ai gjithashtu mbështet framework të ndryshme, duke përfshirë PyTorch dhe TensorFlow.

Burimi:


Burimi: 3dnews.ru
Bleni hostim tĂ« besueshĂ«m pĂ«r faqe me mbrojtje nga DDoS, serverĂ« VPS VDS đŸ”„ Bleni hostim tĂ« besueshĂ«m pĂ«r faqe me mbrojtje nga DDoS, serverĂ« VPS VDS | ProHoster