Разработчиците на библиотеката Vosk публикуваха нови модели за разпознаване на руска реч: сървърната vosk-model-ru-0.22 и мобилната Vosk-model-small-ru-0.22. В моделите са използвани нови речеви данни, а също така и нова невронна архитектура, което увеличава точността на разпознаване с 10-20%. Кодът и данните се разпространяват под лицензия Apache 2.0.
Важно изменение:
- Новите данни, събрани от гласовите колони, значително подобряват разпознаването на речеви команди, произнесени от разстояние.
- Новата схема за извличане на звук значително подобри точността на разпознаване за широколентови записи. В същото време, точността на разпознаване в телекомуникации също беше подобрена.
- Пакетът за допълнение на речника позволява настройване на разпознаването на сложни технически записи.
За най-добра точност се препоръчва актуализиране на версията на Vosk до 0.3.32. Също така могат да бъдат интересни новите възможности на Vosk — интеграции с Unity, Nativescript, Jigasi. Модели за разпознаване на казахски и украински езици. Сървърният модел изисква модерен процесор и 8ГБ памет. Мобилният модел може да се използва на телефони и RaspberryPi 3+.
Източник: opennet.ru
