Das Unternehmen Mozilla hat die Sprachdatensätze von Common Voice aktualisiert, die Beispiele für die Aussprache von über 200.000 Personen enthalten. Die Daten werden als öffentliches Gut (CC0) veröffentlicht. Die vorgeschlagenen Datensätze können in maschinellen Lernsystemen zur Erstellung von Modellen für Sprach-erkennung und -synthese verwendet werden.
Im Vergleich zum letzten Update ist das Volumen des Sprachmaterials in der Sammlung von 23,8 auf 25,8 Tausend Stunden Sprache gestiegen. An der Erstellung von Materialien in englischer Sprache haben über 88.000 Personen mitgewirkt, die 3.161 Stunden Sprache diktiert haben (früher waren es 84.000 Teilnehmer und 3.098 Stunden). Der Satz für die belarussische Sprache umfasst 7.903 Teilnehmer und 1.419 Stunden Sprachmaterial (zuvor 6.965 Teilnehmer und 1.217 Stunden), für die russische Sprache sind es 2.815 Teilnehmer und 229 Stunden (früher 2.731 Teilnehmer und 215 Stunden), für die usbekische Sprache 2.092 Teilnehmer und 262 Stunden (früher 2.025 Teilnehmer und 258 Stunden), und für die ukrainische Sprache sind es 780 Teilnehmer und 87 Stunden (früher 759 Teilnehmer und 87 Stunden).
Das Projekt Common Voice zielt darauf ab, die Zusammenarbeit zur Ansammlung einer Datenbank von Sprachmustern zu organisieren, die die gesamte Vielfalt von Stimmen und Sprachstilen berücksichtigt. Den Nutzern wird angeboten, die auf dem Bildschirm angezeigten Sätze zu sprechen oder die Qualität der von anderen Nutzern hinzugefügten Daten zu bewerten. Die angesammelte Datenbank mit Aufnahmen unterschiedlicher Aussprachen typischer menschlicher Sprachsätze kann ohne Einschränkungen in maschinellen Lernsystemen und in Forschungsprojekten verwendet werden.
Quelle: opennet.ru
