Компания Mozilla обнови наборите о гласови данни Common Voice, които включват примери за произношението на над 200 хиляди души. Данните са публикувани като обществено достояние (CC0). Предоставените набори могат да се използват в системи за машинно обучение за изграждане на модели за разпознаване и синтез на реч. В сравнение с предишното обновление, обемът на речевия материал в колекцията е увеличен от 31.8 до 32.6 хиляди часа реч, от които над 20 хиляди часа са преминали процедурата за проверка. Броят на поддържаните езици се е увеличил от 129 на 131.
В подготовката на материалите на английски език са участвали 93.9 хиляди души, които са надиктовали 3587 часа реч (имаше 93.3 хиляди участници и 3554 часа). Наборът за белоруски език обхваща 8444 участници и 1846 часа речеви материали (беше — 8400 участници и 1815 часа), руски език — 3296 участници и 278 часа (имаше 3241 участник и 277 часа), узбекски — 2200 участници и 265 часа (беше 2189 участници и 265 часа), украински език — 1104 участника и 114 часа (имаше 1091 участник и 113 часа).
Проектът Common Voice е насочен към организиране на съвместна работа по натрупване на база гласови шаблони, отчитаща всичкото разнообразие на гласовете и манерите на реч. На потребителите се предлага да озвучат изписаните на екрана фрази или да оценят качеството на данните, добавени от други потребители. Натрупаната база данни с записи на различни произношения на стандартни фрази на човешки език без ограничения може да се използва в системи за машинно обучение и в изследователски проекти.
Източник: opennet.ru
