Compania Mozilla a actualizat seturile de date vocale Common Voice, incluzând exemple de pronunție de la peste 200 de mii de oameni. Datele sunt publicate ca domeniu public (CC0). Seturile propuse pot fi utilizate în sistemele de învățare automată pentru construirea modelelor de recunoaștere și sinteză a vocii. Comparativ cu actualizarea anterioară, volumul materialelor vorbite din colecție a crescut de la 28,7 la 30,3 mii de ore de voce, dintre care 19,7 mii de ore au trecut printr-un proces de verificare. Numărul limbilor susținute a crescut de la 114 la 120 (au fost adăugate idiș, latgalian, ligurian, ossetic, telugu și warianta occidentală a nahuatl-ului din Sierra Puebla).
La pregătirea materialelor în limba engleză au participat 90,67 mii de persoane, care au dictat 3438 de ore de voce (au fost 88,9 mii de participanți și 3347 de ore). Setul pentru limba belarusă acoperă 8249 de participanți și 1641 de ore de material vocal (au fost 8205 de participanți și 1632 de ore), pentru limba rusă — 3133 de participanți și 265 de ore (au fost 3053 de participanți și 260 de ore), pentru limba uzbecă — 2151 de participanți și 264 de ore (au fost 2141 de participanți și 263 de ore), iar pentru limba ucraineană — 1058 de participanți și 108 ore (au fost 1024 de participanți și 105 ore).
Proiectul Common Voice vizează organizarea unei colaborări pentru acumularea unei baze de șabloane vocale, care să reflecte toată diversitatea vocii și a stilurilor de vorbire. Utilizatorii sunt încurajați să dicteze frazele afișate pe ecran sau să evalueze calitatea datelor adăugate de alți utilizatori. Baza de date acumulată, cu înregistrări ale diverselor pronunții ale frazelor uzuale ale vorbitorilor, poate fi utilizată fără restricții în sistemele de învățare automată și în proiecte de cercetare.
Sursa: opennet.ro
