Mozilla rozwija własny system tłumaczenia maszynowego.

Firma Mozilla w ramach projektu Bergamot rozpoczęła tworzenie systemu tłumaczenia maszynowego działającego po stronie przeglądarki. Projekt umożliwi zintegrowanie w Firefox samodzielnego silnika tłumaczenia stron, który nie będzie korzystał z zewnętrznych usług w chmurze i będzie przetwarzał dane wyłącznie w systemie użytkownika. Głównym celem rozwoju jest zapewnienie prywatności oraz ochrona danych użytkownika przed ewentualnymi wyciekami podczas tłumaczenia treści otwieranych w przeglądarce.

Rozwój Bergamot prowadzi biuro Mozilla w Berlinie przy udziale badaczy z kilku uniwersytetów w Wielkiej Brytanii, Estonii i Czechach. Rozwój jest finansowany przez Unię Europejską w ramach grantu uzyskanego w programie Horyzont 2020. Wartość grantu wynosi trzy miliony euro. Projekt jest zaplanowany na trzy lata. W Mozilla otwarta jest oferta pracy specjalisty ds. systemów uczenia maszynowego do udziału w rozwoju silnika do tłumaczenia z jednego języka na inny.

Spośród pokrewnych projektów związanych z projektem Bergamot, wspomniano:

  • Rozwijany na Uniwersytecie Edynburskim framework tłumaczenia maszynowego Marian, oparty na rekurencyjnej sieci neuronowej. Framework jest napisany w języku C++, może korzystać z GPU do przyspieszenia uczenia i tłumaczenia, i dostarczany na licencji MIT.
  • Opracowane na Uniwersytecie Praskim narzędzie Neural Monkey do przetwarzania informacji w naturalnym języku z wykorzystaniem metod sekwencyjnego uczenia maszynowego. Projekt stosuje framework TensorFlow i może być używany do szybkiego tworzenia prototypów systemów tłumaczenia maszynowego oraz klasyfikacji informacji w naturalnym języku. Kod jest dostępny na licencji BSD.
  • Opracowany na Uniwersytecie Sheffield projekt QuEst++, stosowany do oceny i przewidywania jakości systemów tłumaczenia maszynowego.
  • Projekty rozwijane w Mozilla syntezator mowy (TTS) i silnik rozpoznawania mowy (Deep Speech)
  • Finansowany przez Unię Europejską projekt ParaCrawl, gromadzący bazę synchronnych tłumaczeń różnych fraz w różnych językach, która może być używana do treningu systemów uczenia maszynowego. Podstawą projektu jest bot bitextor, który indeksuje wielojęzyczne strony internetowe i automatycznie znajduje identyczne teksty prezentowane w kilku językach. Baza przykładów tłumaczeń równoległych jest tworzona dla 24 języków, w tym dla rosyjskiego (Baza danych dla języka rosyjskiego zajmuje 637 MB w skompresowanej formie i zawiera ponad 12 mln przykładów tłumaczeń).

Rozwój Bergamot rozpoczął się w styczniu tego roku, ale osiągnięcia projektu jak na razie niedostępne są na etapie publicznego testowania. Niemniej jednak, kilka dni temu programiści opublikowali udostępnili wideo z demonstracją wstępnego prototypu.

Odtwarzaj wideo

Przypomnijmy, że w Firefoxie już jest istnieje wbudowany mechanizm do tłumaczenia stron, jednak jest on związany z korzystaniem z zewnętrznych serwisów chmurowych (obsługiwane są Google, Yandex i Bing) i nie jest aktywowany domyślnie (aby włączyć, należy zmienić ustawienia „browser.translation” w about:config). Mechanizm tłumaczenia wspiera także automatyczne wykrywanie języka, gdy strona jest otwierana w nieznanym języku, i wyświetla specjalny wskaźnik z propozycją przetłumaczenia strony. Prototyp systemu tłumaczenia rozwijanego w ramach projektu Bergamot wykorzystuje ten sam interfejs do interakcji z użytkownikiem, ale zamiast korzystać z zewnętrznych serwisów uruchamiany jest wbudowany procesor.

Źródło: opennet.ru

Kup solidny hosting stron z ochroną przed DDoS, serwery VPS VDS 🔥 Kup solidny hosting stron z ochroną przed DDoS, serwery VPS VDS | ProHoster