Aktualizacja danych głosowych Mozilla Common Voice 12.0

Firma Mozilla zaktualizowała zbiory danych głosowych Common Voice, obejmujące przykłady wymowy ponad 200 tysięcy osób. Dane są publikowane jako własność publiczna (CC0). Proponowane zbiory można wykorzystać w systemach uczenia maszynowego do budowy modeli rozpoznawania i syntezy mowy.

W porównaniu do poprzedniej aktualizacji, objętość materiału głosowego w kolekcji wzrosła z 23,8 do 25,8 tysiąca godzin mowy. W przygotowaniu materiałów w języku angielskim wzięło udział ponad 88 tysięcy osób, które nagrały 3161 godzin mowy (wcześniej 84 tysiące uczestników i 3098 godzin). Zestaw dla języka białoruskiego obejmuje 7903 uczestników i 1419 godzin materiału głosowego (wcześniej 6965 uczestników i 1217 godzin), języka rosyjskiego — 2815 uczestników i 229 godzin (wcześniej 2731 uczestnik i 215 godzin), języka uzbeckiego — 2092 uczestników i 262 godziny (wcześniej 2025 uczestników i 258 godzin), języka ukraińskiego — 780 uczestników i 87 godzin (wcześniej 759 uczestników i 87 godzin).

Projekt Common Voice koncentruje się na organizacji wspólnej pracy nad gromadzeniem bazy wzorców głosowych, która uwzględnia wszelkie różnorodności głosów i manier mowy. Użytkownicy są zachęcani do wymawiania wyświetlanych na ekranie zdań lub oceny jakości danych dodanych przez innych użytkowników. Zgromadzoną bazę danych z nagraniami różnorodnej wymowy typowych fraz mowy ludzkiej bez ograniczeń można wykorzystać w systemach uczenia maszynowego oraz w projektach badawczych.

Źródło: opennet.ru

Kup solidny hosting stron z ochroną przed DDoS, serwery VPS VDS 🔥 Kup solidny hosting stron z ochroną przed DDoS, serwery VPS VDS | ProHoster