L'azienda Mozilla ha aggiornato i pacchetti di dati vocali Common Voice, che includono esempi di pronuncia di oltre 200.000 persone. I dati sono stati pubblicati come dominio pubblico (CC0). I pacchetti proposti possono essere utilizzati nei sistemi di apprendimento automatico per costruire modelli di riconoscimento e sintesi vocale. Rispetto all'aggiornamento precedente, il volume del materiale vocale nella collezione è aumentato da 31,8 a 32,6 mila ore di parlato, di cui oltre 20 mila ore hanno superato la procedura di verifica. Il numero di lingue supportate è aumentato da 129 a 131.
Nella preparazione dei materiali in inglese hanno partecipato 93.900 persone, che hanno registrato 3.587 ore di parlato (erano 93.300 partecipanti e 3.554 ore). Il pacchetto per la lingua bielorussa comprende 8.444 partecipanti e 1.846 ore di materiale vocale (erano 8.400 partecipanti e 1.815 ore), per la lingua russa - 3.296 partecipanti e 278 ore (c'era 3.241 partecipante e 277 ore), per l'uzbeko - 2.200 partecipanti e 265 ore (erano 2.189 partecipanti e 265 ore), per la lingua ucraina - 1.104 partecipanti e 114 ore (erano 1.091 partecipanti e 113 ore).
Il progetto Common Voice mira a organizzare una collaborazione per accumulare una base di modelli vocali che tenga conto di tutta la varietà di voci e modi di parlare. Gli utenti sono invitati a vocalizzare le frasi visualizzate sullo schermo o a valutare la qualità dei dati aggiunti da altri utenti. La base di dati accumulata con registrazioni di varie pronunce di frasi tipiche del linguaggio umano può essere utilizzata senza restrizioni in sistemi di apprendimento automatico e in progetti di ricerca.
Fonte: opennet.ru
