Compania Mozilla a actualizat seturile de date vocale Common Voice, incluzând exemple de pronunție de la peste 200 de mii de persoane. Datele sunt publicate ca domeniu public (CC0). Seturile propuse pot fi utilizate în sistemele de învățare automată pentru construirea de modele de recunoaștere și sinteză a vocii. Comparativ cu actualizarea precedentă, volumul materialului audio din colecție a crescut de la 32,6 la 33,1 mii ore de vorbire, dintre care 22,1 mii ore au trecut printr-un proces de verificare. Numărul limbilor susținute a crescut de la 129 la 133 — au fost adăugate limbile aragonese, isiNdebele, sud Sotho și Tupi.
La pregătirea materialelor în limba engleză au participat 94,9 mii de persoane, care au dictat 3631 de ore de vorbire (au fost 93,9 mii de participanți și 3587 de ore). Setul pentru limba belarusă cuprinde 8521 de participanți și 1860 de ore de material audio (au fost — 8444 de participanți și 1846 de ore), limba rusă — 3365 de participanți și 281 de ore (au fost 3296 de participanți și 278 de ore), limba uzbecă — 2211 participanți și 265 de ore (au fost 2200 de participanți și 265 de ore), limba ucraineană — 1120 de participanți și 114 ore (au fost 1104 participanți și 114 ore).
Proiectul Common Voice organizează o colaborare pentru acumularea unei baze de date vocale, care să reflecte toată diversitatea vocii și stilurilor de vorbire. Utilizatorii sunt invitați să enunțe frazele afișate pe ecran sau să evalueze calitatea datelor adăugate de alți utilizatori. Baza de date acumulată cu înregistrări de pronunție variată a frazelor tipice ale vocii umane, fără restricții, poate fi utilizată în sistemele de învățare automată și în proiectele de cercetare.
Sursa: opennet.ro
