Die Firma Mozilla hat die Sprachdatensätze von Common Voice aktualisiert, die Beispiele für die Aussprache von mehr als 200.000 Personen enthalten. Die Daten wurden als öffentliches Gut (CC0) veröffentlicht. Die angebotenen Sätze können in maschinellen Lernsystemen zur Erstellung von Modellen zur Spracherkennung und Sprachsynthese verwendet werden. Im Vergleich zum letzten Update hat sich das Volumen des Sprachmaterials in der Sammlung von 28,7 auf 30,3 Tausend Stunden Sprache erhöht, von denen 19,7 Tausend Stunden überprüft wurden. Die Anzahl der unterstützten Sprachen ist von 114 auf 120 gestiegen (neu hinzugekommen sind Jiddisch, Lettgallisch, Ligurisch, Ossetisch, Telugu und West-Sierra-Pueblan Nahuatl).
An der Erstellung von Materialien in englischer Sprache haben 90.67 Tausend Personen teilgenommen, die 3438 Stunden Sprache diktierten (es waren 88.9 Tausend Teilnehmer und 3347 Stunden). Das Set für die belarussische Sprache umfasst 8249 Teilnehmer und 1641 Stunden Sprachmaterial (es waren 8205 Teilnehmer und 1632 Stunden), für die russische Sprache 3133 Teilnehmer und 265 Stunden (es waren 3053 Teilnehmer und 260 Stunden), für das usbekische 2151 Teilnehmer und 264 Stunden (es waren 2141 Teilnehmer und 263 Stunden), für die ukrainische Sprache 1058 Teilnehmer und 108 Stunden (es waren 1024 Teilnehmer und 105 Stunden).
Das Common Voice-Projekt zielt darauf ab, die Zusammenarbeit zur Erstellung einer Datenbank von Sprachmustern zu organisieren, die die gesamte Vielfalt von Stimmen und Sprechstilen berücksichtigt. Nutzer können die auf dem Bildschirm angezeigten Sätze vertonen oder die Qualität von Daten bewerten, die von anderen Nutzern hinzugefügt wurden. Die gesammelte Datenbank mit Aufnahmen verschiedener Aussprachen typischer menschlicher Sprache kann ohne Einschränkungen in Systemen des maschinellen Lernens und in Forschungsprojekten verwendet werden.
Quelle: opennet.ru
