Die Mozilla Corporation hat die Datensätze der Common Voice-Stimmen aktualisiert, die Beispiele der Aussprache von über 200.000 Personen enthalten. Die Daten wurden als öffentliches Gut veröffentlicht (CC0). Die vorgeschlagenen Datensätze können in maschinellen Lernsystemen verwendet werden, um Modelle für Sprach- und Sprachsynthese zu erstellen. Im Vergleich zum vorherigen Update ist das Volumen des Sprachmaterials in der Sammlung von 31,8 auf 32,6 Tausend Stunden gestiegen, von denen über 20.000 Stunden geprüft wurden. Die Anzahl der unterstützten Sprachen hat sich von 129 auf 131 erhöht.
An der Erstellung der englischen Materialien waren 93,9 Tausend Personen beteiligt, die 3.587 Stunden Sprache diktiert haben (zuvor waren es 93,3 Tausend Teilnehmer und 3.554 Stunden). Der Datensatz für die belarussische Sprache umfasst 8.444 Teilnehmer und 1.846 Stunden Sprachmaterial (zuvor waren es 8.400 Teilnehmer und 1.815 Stunden), für die russische Sprache 3.296 Teilnehmer und 278 Stunden (zuvor 3.241 Teilnehmer und 277 Stunden), für die usbekische Sprache 2.200 Teilnehmer und 265 Stunden (zuvor 2.189 Teilnehmer und 265 Stunden), für die ukrainische Sprache 1.104 Teilnehmer und 114 Stunden (zuvor 1.091 Teilnehmer und 113 Stunden).
Das Common Voice-Projekt zielt darauf ab, die Zusammenarbeit zur Erstellung einer Datenbank von Sprachmustern zu organisieren, die die gesamte Vielfalt von Stimmen und Sprechstilen berücksichtigt. Nutzer können die auf dem Bildschirm angezeigten Sätze vertonen oder die Qualität von Daten bewerten, die von anderen Nutzern hinzugefügt wurden. Die gesammelte Datenbank mit Aufnahmen verschiedener Aussprachen typischer menschlicher Sprache kann ohne Einschränkungen in Systemen des maschinellen Lernens und in Forschungsprojekten verwendet werden.
Quelle: opennet.ru
