Mozilla ha aggiornato i set di dati vocali di Common Voice, includendo esempi di pronuncia di oltre 200.000 persone. I dati sono stati pubblicati come dominio pubblico (CC0). I set proposti possono essere utilizzati nei sistemi di apprendimento automatico per costruire modelli di riconoscimento e sintesi vocale. Rispetto al precedente aggiornamento, il volume del materiale vocale nella collezione è aumentato da 32,6 a 33,1 mila ore di parlato, di cui 22,1 mila ore sono state sottoposte a verifica. Il numero di lingue supportate è aumentato da 129 a 133 — sono state aggiunte le lingue aragonese, isiNdebele, Sotho meridionale e Tupi.
Alla preparazione dei materiali in lingua inglese hanno partecipato 94.900 persone, che hanno registrato 3.631 ore di parlato (ci sono stati 93.900 partecipanti e 3.587 ore). Il set per la lingua bielorussa include 8.521 partecipanti e 1.860 ore di materiale vocale (c'erano 8.444 partecipanti e 1.846 ore), per la lingua russa — 3.365 partecipanti e 281 ore (c'erano 3.296 partecipanti e 278 ore), per l'uzbeko — 2.211 partecipanti e 265 ore (c'erano 2.200 partecipanti e 265 ore), e per l'ucraino — 1.120 partecipanti e 114 ore (c'erano 1.104 partecipanti e 114 ore).
Il progetto Common Voice promuove la collaborazione per la creazione di un database di modelli vocali che tiene conto di tutta la varietà di voci e modi di parlare. Gli utenti possono registrare le frasi visualizzate sullo schermo o valutare la qualità dei dati forniti da altri utenti. Il database accumulato, con registrazioni di diverse pronunce di frasi comuni, può essere utilizzato senza limitazioni in sistemi di apprendimento automatico e progetti di ricerca.
Fonte: opennet.ru
