Mozilla ha aggiornato i set di dati vocali di Common Voice, che includono esempi di pronuncia di oltre 200.000 persone. I dati sono pubblicati come pubblico dominio (CC0). I set proposti possono essere utilizzati nei sistemi di apprendimento automatico per costruire modelli di riconoscimento e sintesi vocale.
Rispetto all'aggiornamento precedente, il volume del materiale vocale nella collezione è aumentato da 23,8 a 25,8 mila ore di discorso. Nella preparazione dei materiali in lingua inglese hanno partecipato oltre 88.000 persone, che hanno registrato 3161 ore di discorso (ci sono stati 84.000 partecipanti e 3098 ore). Il set per la lingua bielorussa coinvolge 7903 partecipanti e 1419 ore di materiale vocale (c'erano 6965 partecipanti e 1217 ore), per la lingua russa 2815 partecipanti e 229 ore (c'erano 2731 partecipanti e 215 ore), per l'uzbeko 2092 partecipanti e 262 ore (c'erano 2025 partecipanti e 258 ore), per l'ucraino 780 partecipanti e 87 ore (c'erano 759 partecipanti e 87 ore).
Il progetto Common Voice mira a organizzare una collaborazione per costruire un database di campioni vocali che tenga conto di tutta la varietà di voci e stili di parlato. Gli utenti sono invitati a vocalizzare le frasi visualizzate sullo schermo o a valutare la qualità dei dati aggiunti da altri utenti. Il database accumulato con registrazioni di diverse pronunce di frasi comuni può essere utilizzato senza restrizioni in sistemi di apprendimento automatico e in progetti di ricerca.
Fonte: opennet.ru
