Mozilla ha aggiornato i set di dati vocali Common Voice, che includono esempi di pronuncia di oltre 200.000 persone. I dati sono stati pubblicati come dominio pubblico (CC0). I set proposti possono essere utilizzati nei sistemi di machine learning per costruire modelli di riconoscimento e sintesi vocale. Rispetto all'aggiornamento precedente, il volume del materiale vocale nella collezione è aumentato da 31,8 a 32,6 mila ore di parlato, di cui oltre 20.000 ore hanno superato il processo di verifica. Il numero delle lingue supportate è aumentato da 129 a 131.
Nella preparazione dei materiali in lingua inglese sono stati coinvolti 93.9 mila partecipanti, che hanno registrato 3587 ore di discorso (precedentemente erano 93.3 mila partecipanti e 3554 ore). Il pacchetto per la lingua bielorussa comprende 8444 partecipanti e 1846 ore di materiale vocale (rispetto ai precedenti 8400 partecipanti e 1815 ore), per la lingua russa ci sono 3296 partecipanti e 278 ore (rispetto ai 3241 partecipanti e 277 ore), per l'uzbeco ci sono 2200 partecipanti e 265 ore (rispetto ai 2189 partecipanti e 265 ore), per l'ucraino ci sono 1104 partecipanti e 114 ore (rispetto ai 1091 partecipanti e 113 ore).
Il progetto Common Voice mira a organizzare una collaborazione per costruire un database di campioni vocali che tenga conto di tutta la varietà di voci e stili di parlato. Gli utenti sono invitati a vocalizzare le frasi visualizzate sullo schermo o a valutare la qualità dei dati aggiunti da altri utenti. Il database accumulato con registrazioni di diverse pronunce di frasi comuni può essere utilizzato senza restrizioni in sistemi di apprendimento automatico e in progetti di ricerca.
Fonte: opennet.ru
