Compania Mozilla a actualizat seturile de date vocale Common Voice, incluzând exemple de pronunție de la peste 200 de mii de persoane. Datele sunt publicate ca domeniu public (CC0). Seturile propuse pot fi folosite în sistemele de învățare automată pentru construirea de modele de recunoaștere și sinteză vocală. Comparativ cu actualizarea anterioară, volumul materialului vocal din colecție a crescut de la 31,8 la 32,6 mii ore de vorbire, dintre care peste 20 de mii de ore au fost supuse unei proceduri de verificare. Numărul limbilor suportate a crescut de la 129 la 131.
În pregătirea materialelor în limba engleză au participat 93,9 mii de persoane, care au dictat 3587 de ore de vorbire (erau 93,3 mii de participanți și 3554 de ore). Setul pentru limba belarusă cuprinde 8444 de participanți și 1846 de ore de material vocal (erau 8400 de participanți și 1815 ore), pentru limba rusă – 3296 de participanți și 278 de ore (era 3241 de participanți și 277 de ore), pentru limba uzbecă – 2200 de participanți și 265 de ore (erau 2189 de participanți și 265 de ore), pentru limba ucraineană – 1104 participanți și 114 ore (erau 1091 de participanți și 113 ore).
Proiectul Common Voice vizează organizarea unei colaborări pentru acumularea unei baze de șabloane vocale, care să reflecte toată diversitatea vocii și a stilurilor de vorbire. Utilizatorii sunt încurajați să dicteze frazele afișate pe ecran sau să evalueze calitatea datelor adăugate de alți utilizatori. Baza de date acumulată, cu înregistrări ale diverselor pronunții ale frazelor uzuale ale vorbitorilor, poate fi utilizată fără restricții în sistemele de învățare automată și în proiecte de cercetare.
Sursa: opennet.ro
