Mozilla hat im Rahmen des Projekts mit der Entwicklung eines Browsers basierenden maschinellen Übersetzungssystems begonnen. Dieses Projekt ermöglicht die Integration einer eigenständigen Übersetzungs-Engine in Firefox, die keine externen Cloud-Dienste nutzt und Daten ausschließlich auf dem Nutzergerät verarbeitet. Das Hauptziel der Entwicklung besteht darin, die Vertraulichkeit zu gewährleisten und die Daten der Nutzer vor potenziellen Lecks beim Übersetzen von Inhalten der im Browser geöffneten Seiten zu schützen.
Die Entwicklung von Bergamot erfolgt im Berliner Büro von Mozilla in Zusammenarbeit mit Forschern aus Universitäten im Vereinigten Königreich, Estland und Tschechien. Das Projekt wird von der Europäischen Union im Rahmen eines über das Programm finanzierten Zuschusses unterstützt. Die Fördersumme beträgt drei Millionen Euro. Das Projekt ist auf drei Jahre ausgelegt. Bei Mozilla für einen Spezialisten im Bereich maschinelles Lernen ausgeschrieben, um an der Entwicklung der Übersetzungs-Engine von einer Sprache in eine andere mitzuwirken.
Unter den verwandten Entwicklungen mit Bezug zum Bergamot-Projekt :
- der an der Universität Edinburgh entwickelte maschinelle Übersetzungsrahmen , basierend auf einem rekurrenten neuronalen Netzwerk. Das Framework ist in C++ geschrieben und kann GPUs zur Beschleunigung von Lernen und Übersetzung nutzen, und unter der MIT-Lizenz.
- Das in der Karlsuniversität in Prag entwickelte Tool , zur Verarbeitung von Informationen in natürlicher Sprache unter Verwendung von Methoden des sequentiellen maschinellen Lernens. Das Projekt verwendet das TensorFlow-Framework und kann zur schnellen Erstellung von Prototypen für Systeme zur maschinellen Übersetzung und Klassifizierung von Informationen in natürlicher Sprache eingesetzt werden. Der Code ist unter der BSD-Lizenz verfügbar.
- Das in der Universität Sheffield vorbereitete Projekt , das zur Bewertung und Vorhersage der Qualität von Maschinenübersetzungssystemen verwendet wird.
- Entwickelt von Mozilla, () und ()
- Das von der Europäischen Union finanzierte Projekt , das eine Datenbank synchroner Übersetzungen verschiedener Phrasen in verschiedenen Sprachen aufbaut, die zur Schulung von Systemen des maschinellen Lernens genutzt werden kann. Das Projekt basiert auf einem Bot , der mehrsprachige Websites indiziert und automatisch identische Texte findet, die in mehreren Sprachen präsentiert werden. Die Datenbank mit Beispielen für parallele Übersetzungen umfasst 24 Sprachen, darunter auch Russisch ( für die russische Sprache hat eine Größe von 637 MB im komprimierten Format und enthält über 12 Millionen Übersetzungsbeispiele).
Die Entwicklung von Bergamot begann im Januar dieses Jahres, aber die Ergebnisse des Projekts sind bisher für einen öffentlichen Test nicht verfügbar. Dennoch haben die Entwickler vor einigen Tagen ein Video zur Demonstration des ersten Prototyps veröffentlicht.

Wir erinnern daran, dass in Firefox bereits Ein integrierter Mechanismus zur Seitenübersetzung, der jedoch auf die Nutzung externer Cloud-Dienste angewiesen ist (unterstützt werden Google, Yandex und Bing) und standardmäßig nicht aktiviert ist (um ihn zu aktivieren, müssen die Einstellungen "browser.translation" in about:config geändert werden). Der Übersetzungsmechanismus unterstützt auch die automatische Erkennung von Sprachen beim Öffnen einer Seite in einer unbekannten Sprache und zeigt einen speziellen Indikator an, der vorschlägt, die Seite zu übersetzen. Der im Rahmen des Bergamot-Projekts entwickelte Prototyp des Übersetzungssystems verwendet dieselbe Schnittstelle zur Interaktion mit dem Benutzer, läuft jedoch nicht auf externe Dienste zu, sondern startet einen integrierten Handler.
Quelle: opennet.ru
