Mise à jour des données vocales Mozilla Common Voice 12.0

La compagnie Mozilla a mis à jour les ensembles de données vocales Common Voice, incluant des exemples de prononciation de plus de 200 000 personnes. Les données sont publiées comme domaine public (CC0). Les ensembles proposés peuvent être utilisés dans des systèmes d'apprentissage automatique pour construire des modèles de reconnaissance et de synthèse vocale.

Comparé à la mise à jour précédente, le volume de matériel vocal dans la collection a augmenté de 23,8 à 25,8 milliers d'heures de parole. Plus de 88 000 personnes ont participé à la préparation du matériel en anglais, ayant dicté 3161 heures de discours (il y avait 84 000 participants et 3098 heures auparavant). L'ensemble pour la langue biélorusse couvre 7903 participants et 1419 heures de matériel vocal (il y avait 6965 participants et 1217 heures auparavant), pour la langue russe — 2815 participants et 229 heures (il y avait 2731 participants et 215 heures), pour l'ouzbek — 2092 participants et 262 heures (il y avait 2025 participants et 258 heures), et pour la langue ukrainienne — 780 participants et 87 heures (il y avait 759 participants et 87 heures).

Le projet Common Voice vise à organiser un travail collaboratif pour accumuler une base de modèles vocaux, tenant compte de toute la diversité des voix et des manières de parler. Les utilisateurs sont invités à prononcer les phrases affichées à l'écran ou à évaluer la qualité des données ajoutées par d'autres utilisateurs. La base de données accumulée avec des enregistrements de différentes prononciations de phrases standard de la parole humaine peut être utilisée sans restriction dans des systèmes d'apprentissage automatique et dans des projets de recherche.

Source : opennet.ru

Acheter un hébergement fiable pour les sites avec protection DDoS, serveurs VPS VDS 🔥 Acheter un hébergement fiable pour les sites avec protection DDoS, serveurs VPS VDS | ProHoster