Firma Mozilla zaktualizowała zbiory danych głosowych Common Voice, obejmujące przykłady wymowy ponad 200 tysięcy osób. Dane są publikowane jako własność publiczna (CC0). Proponowane zbiory można wykorzystać w systemach uczenia maszynowego do budowy modeli rozpoznawania i syntezy mowy.
W porównaniu do poprzedniej aktualizacji, objętość materiału głosowego w kolekcji wzrosła z 23,8 do 25,8 tysiąca godzin mowy. W przygotowaniu materiałów w języku angielskim wzięło udział ponad 88 tysięcy osób, które nagrały 3161 godzin mowy (wcześniej 84 tysiące uczestników i 3098 godzin). Zestaw dla języka białoruskiego obejmuje 7903 uczestników i 1419 godzin materiału głosowego (wcześniej 6965 uczestników i 1217 godzin), języka rosyjskiego — 2815 uczestników i 229 godzin (wcześniej 2731 uczestnik i 215 godzin), języka uzbeckiego — 2092 uczestników i 262 godziny (wcześniej 2025 uczestników i 258 godzin), języka ukraińskiego — 780 uczestników i 87 godzin (wcześniej 759 uczestników i 87 godzin).
Projekt Common Voice koncentruje się na organizacji wspólnej pracy nad gromadzeniem bazy wzorców głosowych, która uwzględnia wszelkie różnorodności głosów i manier mowy. Użytkownicy są zachęcani do wymawiania wyświetlanych na ekranie zdań lub oceny jakości danych dodanych przez innych użytkowników. Zgromadzoną bazę danych z nagraniami różnorodnej wymowy typowych fraz mowy ludzkiej bez ograniczeń można wykorzystać w systemach uczenia maszynowego oraz w projektach badawczych.
Źródło: opennet.ru
