Compania Mozilla a actualizat seturile de date vocale Common Voice, incluzând exemple de pronunție de la peste 200 de mii de persoane. Datele sunt publicate ca bunuri de domeniu public (CC0). Seturile propuse pot fi utilizate în sistemele de învățare automată pentru construirea de modele de recunoaștere și sinteză a vorbirii.
Comparativ cu actualizarea anterioară, volumul materialului vorbit din colecție a crescut de la 23,8 la 25,8 mii de ore de vorbire. La pregătirea materialelor în limba engleză au participat peste 88 de mii de persoane, care au dictat 3161 de ore de vorbire (au fost 84 de mii de participanți și 3098 de ore). Setul pentru limba belarusă acoperă 7903 participanți și 1419 ore de material vorbit (au fost 6965 de participanți și 1217 ore), limba rusă — 2815 participanți și 229 de ore (au fost 2731 de participanți și 215 ore), limba uzbecă — 2092 de participanți și 262 de ore (au fost 2025 de participanți și 258 de ore), iar limba ucraineană — 780 de participanți și 87 de ore (au fost 759 de participanți și 87 de ore).
Proiectul Common Voice vizează organizarea unei colaborări pentru acumularea unei baze de șabloane vocale, care să reflecte toată diversitatea vocii și a stilurilor de vorbire. Utilizatorii sunt încurajați să dicteze frazele afișate pe ecran sau să evalueze calitatea datelor adăugate de alți utilizatori. Baza de date acumulată, cu înregistrări ale diverselor pronunții ale frazelor uzuale ale vorbitorilor, poate fi utilizată fără restricții în sistemele de învățare automată și în proiecte de cercetare.
Sursa: opennet.ro
