Компания Mozilla актуализира наборите на гласови данни Common Voice, които включват примери за произношение от повече от 200 хиляди души. Данните са публикувани като обществено достояние (CC0). Предложените набори могат да се използват в системи за машинно обучение за изграждане на модели за разпознаване и синтез на реч.
В сравнение с предходящото обновление обемът на речевия материал в колекцията увеличи от 23.8 до 25.8 хиляди часа реч. В подготовката на материали на английски език участваха над 88 хиляди души, които диктуваха 3161 час реч (предишно бяха 84 хиляди участници и 3098 часа). Наборът за беларуските език обхваща 7903 участника и 1419 часа речев материал (преди — 6965 участници и 1217 часа), руския език — 2815 участника и 229 часа (предишно 2731 участник и 215 часа), узбекския — 2092 участника и 262 часа (предишно 2025 участници и 258 часа), украинския език — 780 участника и 87 часа (предишно 759 участници и 87 часа).
Проектът Common Voice е насочен към организиране на съвместна работа по натрупване на база гласови шаблони, отчитаща всичкото разнообразие на гласовете и манерите на реч. На потребителите се предлага да озвучат изписаните на екрана фрази или да оценят качеството на данните, добавени от други потребители. Натрупаната база данни с записи на различни произношения на стандартни фрази на човешки език без ограничения може да се използва в системи за машинно обучение и в изследователски проекти.
Източник: opennet.ru
