Yandex udostępnił publicznie model językowy YandexGPT-5-Lite
Architektura nowego modelu językowego jest podobna do Llama lub Qwen, ale została w pełni wytrenowana od podstaw. Podobieństwo pozwala na używanie tego samego zestawu narzędzi. Wersja Pretrain dużego modelu językowego YandexGPT 5 Lite posiada 8B parametrów i długość kontekstu wynoszącą 32k tokenów. Podczas szkolenia modelu szczególną uwagę zwrócono na język rosyjski, materiały w języku rosyjskim stanowiły ponad 70% zbioru danych. Starszy model YandexGPT 5 […]
