Yandex ha reso disponibile al pubblico il modello linguistico YandexGPT-5-Lite
L'architettura del nuovo modello linguistico è simile a quella di Llama o Qwen, ma è stata addestrata completamente da zero. La somiglianza consente di utilizzare gli stessi strumenti. La versione pre-addestrata del grande modello linguistico YandexGPT 5 Lite ha 8 miliardi di parametri con una lunghezza del contesto di 32k token. Durante l'addestramento del modello, particolare attenzione è stata dedicata alla lingua russa, con materiali in russo che hanno costituito oltre il 70% del dataset. Il modello avanzato YandexGPT 5 […]
