Yandex hat das Sprachmodell YandexGPT-5-Lite zur öffentlichen Nutzung freigegeben.
Die Architektur des neuen Sprachmodells ähnelt Llama oder Qwen, wurde aber von Grund auf neu entwickelt. Ähnlichkeiten ermöglichen die Verwendung derselben Werkzeuge. Die Pretrain-Version des großen Sprachmodells YandexGPT 5 Lite hat 8B Parameter und eine Kontextlänge von 32k Token. Bei der Modelldevlopierung wurde besonderes Augenmerk auf die russische Sprache gelegt; Materialien in russischer Sprache machten mehr als 70 % des Datasets aus. Das größere Modell YandexGPT 5 […]
