L'azienda Mozilla ha aggiornato i pacchetti di dati vocali Common Voice, che includono esempi di pronuncia di oltre 200.000 persone. I dati sono stati pubblicati come dominio pubblico (CC0). I pacchetti proposti possono essere utilizzati nei sistemi di apprendimento automatico per costruire modelli di riconoscimento e sintesi vocale. Rispetto all'aggiornamento precedente, il volume del materiale vocale nella collezione è aumentato da 28,7 a 30,3 mila ore di discorsi, delle quali 19,7 mila ore hanno superato il processo di verifica. Il numero delle lingue supportate è aumentato da 114 a 120 (aggiunte le lingue yiddish, latgalico, ligure, osseto, telugu e il nauatl occidentale di Sierra Puebla).
Alla preparazione dei materiali in lingua inglese hanno partecipato 90.670 persone, che hanno registrato 3.438 ore di discorsi (c'erano 88.900 partecipanti e 3.347 ore). Il pacchetto per la lingua bielorussa comprende 8.249 partecipanti e 1.641 ore di materiale vocale (c'erano 8.205 partecipanti e 1.632 ore), per la lingua russa - 3.133 partecipanti e 265 ore (c'erano 3.053 partecipanti e 260 ore), per l'uzbeko - 2.151 partecipanti e 264 ore (c'erano 2.141 partecipanti e 263 ore), per la lingua ucraina - 1.058 partecipanti e 108 ore (c'erano 1.024 partecipanti e 105 ore).
Il progetto Common Voice mira a organizzare una collaborazione per accumulare una base di modelli vocali che tenga conto di tutta la varietà di voci e modi di parlare. Gli utenti sono invitati a vocalizzare le frasi visualizzate sullo schermo o a valutare la qualità dei dati aggiunti da altri utenti. La base di dati accumulata con registrazioni di varie pronunce di frasi tipiche del linguaggio umano può essere utilizzata senza restrizioni in sistemi di apprendimento automatico e in progetti di ricerca.
Fonte: opennet.ru
