Google Translatotron – eine Technologie für die synchronisierte Sprachübersetzung, die die Stimme des Benutzers imitiert

Die Entwickler von Google haben ein neues Projekt vorgestellt, in dessen Rahmen eine Technologie geschaffen wurde, die in der Lage ist, gesprochene Sätze von einer Sprache in eine andere zu übersetzen. Der Hauptunterschied des neuen Übersetzers namens Translatotron im Vergleich zu ähnlichen Technologien besteht darin, dass er ausschließlich mit Audio arbeitet, ohne dabei einen Zwischentext zu verwenden. Dieser Ansatz hat die Arbeitsgeschwindigkeit des Übersetzers erheblich erhöht. Ein weiterer bemerkenswerter Punkt ist, dass das System die Frequenz und den Ton des Sprechers relativ genau imitiert.

Die Entwicklung des Translatotron war das Ergebnis kontinuierlicher Arbeit, die mehrere Jahre in Anspruch nahm. Forscher von Google haben lange Zeit die Möglichkeit des direkten Umwandelns von Sprache untersucht, konnten das Vorhaben jedoch bis vor kurzem nicht umsetzen.

Google Translatotron – eine Technologie für die synchronisierte Sprachübersetzung, die die Stimme des Benutzers imitiert

Heutzutage arbeiten die Systeme für die synchronisierte Übersetzung meist nach demselben Algorithmus. Zu Beginn wird die Ausgangssprache in Text umgewandelt. Anschließend wird der Text in einer Sprache in Text in einer anderen Sprache umgewandelt. Danach wird der gewonnene Text in Sprache in der gewünschten Sprache umgewandelt. Diese Methode funktioniert zwar gut, ist jedoch nicht ohne Mängel. An jedem Schritt können Fehler auftreten, die sich überlagern und die Übersetzungsqualität mindern.

Um das gewünschte Ergebnis zu erzielen, haben die Forscher die Analyse von Schallspektren durchgeführt. Sie versuchten, die Spektrogramme einer Sprache direkt in die Spektrogramme einer anderen Sprache zu verwandeln und die Schritte zur Umwandlung von Klang in Text zu überspringen.


Google Translatotron – eine Technologie für die synchronisierte Sprachübersetzung, die die Stimme des Benutzers imitiert

Es ist erwähnenswert, dass trotz der Komplexität einer solchen Umwandlung die Sprachverarbeitung in einem Schritt erfolgt, anstatt in dreien, wie das zuvor der Fall war. Mit ausreichenden Rechenressourcen wird Translatotron die synchronisierte Übersetzung deutlich schneller durchführen. Ein weiterer wichtiger Punkt ist, dass dieser Ansatz es ermöglicht, die Eigenschaften und die Intonation der ursprünglichen Stimme zu bewahren.

In diesem Stadium kann Translatotron nicht mit der hohen Genauigkeit klassischer Systeme aufwarten. Dennoch berichten die Forscher, dass die meisten durchgeführten Übersetzungen von ausreichender Qualität sind. In Zukunft wird die Arbeit an Translatotron fortgesetzt, da die Forscher beabsichtigen, die Qualität der simultanen Sprachübersetzung zu verbessern.



Quelle: 3dnews.ru
60GB SSD 8Gb DDR4