Aktualisierung der Sprachdaten von Mozilla Common Voice 12.0.

Das Unternehmen Mozilla hat die SprachdatensĂ€tze von Common Voice aktualisiert, die Beispiele fĂŒr die Aussprache von ĂŒber 200.000 Personen enthalten. Die Daten werden als öffentliches Gut (CC0) veröffentlicht. Die vorgeschlagenen DatensĂ€tze können in maschinellen Lernsystemen zur Erstellung von Modellen fĂŒr Sprach-erkennung und -synthese verwendet werden.

Im Vergleich zum letzten Update ist das Volumen des Sprachmaterials in der Sammlung von 23,8 auf 25,8 Tausend Stunden Sprache gestiegen. An der Erstellung von Materialien in englischer Sprache haben ĂŒber 88.000 Personen mitgewirkt, die 3.161 Stunden Sprache diktiert haben (frĂŒher waren es 84.000 Teilnehmer und 3.098 Stunden). Der Satz fĂŒr die belarussische Sprache umfasst 7.903 Teilnehmer und 1.419 Stunden Sprachmaterial (zuvor 6.965 Teilnehmer und 1.217 Stunden), fĂŒr die russische Sprache sind es 2.815 Teilnehmer und 229 Stunden (frĂŒher 2.731 Teilnehmer und 215 Stunden), fĂŒr die usbekische Sprache 2.092 Teilnehmer und 262 Stunden (frĂŒher 2.025 Teilnehmer und 258 Stunden), und fĂŒr die ukrainische Sprache sind es 780 Teilnehmer und 87 Stunden (frĂŒher 759 Teilnehmer und 87 Stunden).

Das Projekt Common Voice zielt darauf ab, die Zusammenarbeit zur Ansammlung einer Datenbank von Sprachmustern zu organisieren, die die gesamte Vielfalt von Stimmen und Sprachstilen berĂŒcksichtigt. Den Nutzern wird angeboten, die auf dem Bildschirm angezeigten SĂ€tze zu sprechen oder die QualitĂ€t der von anderen Nutzern hinzugefĂŒgten Daten zu bewerten. Die angesammelte Datenbank mit Aufnahmen unterschiedlicher Aussprachen typischer menschlicher SprachsĂ€tze kann ohne EinschrĂ€nkungen in maschinellen Lernsystemen und in Forschungsprojekten verwendet werden.

Quelle: opennet.ru

ZuverlĂ€ssiges Hosting fĂŒr Websites mit DDoS-Schutz kaufen, VPS VDS Server đŸ”„ ZuverlĂ€ssiges Hosting fĂŒr Websites mit DDoS-Schutz kaufen, VPS VDS Server - ProHoster