L'azienda Mozilla ha aggiornato i set di dati vocali Common Voice, includendo esempi di pronuncia di oltre 200.000 persone. I dati sono stati pubblicati come dominio pubblico (CC0). I set proposti possono essere utilizzati in sistemi di apprendimento automatico per la costruzione di modelli di riconoscimento e sintesi vocale.
Rispetto all'aggiornamento precedente, il volume del materiale vocale nella collezione è aumentato da 23,8 a 25,8 mila ore di parlato. Nella preparazione dei materiali in lingua inglese hanno partecipato oltre 88.000 persone, che hanno registrato 3161 ore di parlato (c'erano 84.000 partecipanti e 3098 ore). Il set per la lingua bielorussa comprende 7903 partecipanti e 1419 ore di materiale vocale (c'erano 6965 partecipanti e 1217 ore), per la lingua russa — 2815 partecipanti e 229 ore (c'erano 2731 partecipanti e 215 ore), per la lingua uzbeka — 2092 partecipanti e 262 ore (c'erano 2025 partecipanti e 258 ore), per la lingua ucraina — 780 partecipanti e 87 ore (c'erano 759 partecipanti e 87 ore).
Il progetto Common Voice mira a organizzare una collaborazione per accumulare una base di modelli vocali che tenga conto di tutta la varietà di voci e modi di parlare. Gli utenti sono invitati a vocalizzare le frasi visualizzate sullo schermo o a valutare la qualità dei dati aggiunti da altri utenti. La base di dati accumulata con registrazioni di varie pronunce di frasi tipiche del linguaggio umano può essere utilizzata senza restrizioni in sistemi di apprendimento automatico e in progetti di ricerca.
Fonte: opennet.ru
