Actualización de datos de voz Mozilla Common Voice 19.0

La compañía Mozilla ha actualizado los conjuntos de datos de voz Common Voice, que incluyen ejemplos de pronunciación de más de 200,000 personas. Los datos se publican como dominio público (CC0). Los conjuntos propuestos pueden utilizarse en sistemas de aprendizaje automático para construir modelos de reconocimiento y síntesis de voz. En comparación con la última actualización, el volumen de material de voz en la colección ha aumentado de 31.8 a 32.6 mil horas de habla, de las cuales más de 20 mil horas han sido verificadas. El número de idiomas soportados ha aumentado de 129 a 131.

En la preparación de materiales en inglés participaron 93,900 personas, quienes dictaron 3,587 horas de habla (había 93,300 participantes y 3,554 horas). El conjunto para el idioma bielorruso abarca 8,444 participantes y 1,846 horas de material hablado (anteriormente había 8,400 participantes y 1,815 horas), el idioma ruso cuenta con 3,296 participantes y 278 horas (antes había 3,241 participantes y 277 horas), el uzbeko tiene 2,200 participantes y 265 horas (había 2,189 participantes y 265 horas), y el idioma ucraniano cuenta con 1,104 participantes y 114 horas (antes había 1,091 participantes y 113 horas).

El proyecto Common Voice tiene como objetivo organizar el trabajo colaborativo para acumular una base de plantillas de voz que considere toda la diversidad de voces y estilos de habla. Se invita a los usuarios a pronunciar las frases mostradas en pantalla o a evaluar la calidad de los datos añadidos por otros usuarios. La base de datos acumulada con las grabaciones de diferentes pronunciaciones de frases típicas del habla humana se puede utilizar sin restricciones en sistemas de aprendizaje automático y en proyectos de investigación.

Fuente: opennet.ru

Compra un hosting fiable para sitios web con protección contra DDoS, servidores VPS VDS 🔥 Compra un hosting fiable para sitios web con protección contra DDoS, servidores VPS VDS | ProHoster