Opublikowano wersję systemu tłumaczenia maszynowego OpenNMT 0.28.0 (Open Neural Machine Translation), korzystającego z metod uczenia maszynowego. Do budowy sieci neuronowej projekt wykorzystuje możliwości biblioteki głębokiego uczenia maszynowego TensorFlow. Kod rozwijanych modułów projektu OpenNMT napisany jest w języku Python i jest rozpowszechniany na licencji MIT. Gotowe modele przygotowane są dla języków angielskiego, niemieckiego i katalońskiego; dla pozostałych języków można samodzielnie skonstruować model na podstawie zestawu danych projektu OPUS (aby przesłać do systemu do nauki dwa pliki — jeden z zdaniami w języku źródłowym i drugi z jakościowym tłumaczeniem tych zdań na język docelowy).
Projekt rozwija się przy udziale firmy SYSTRAN, specjalizującej się w tworzeniu narzędzi do tłumaczenia maszynowego, oraz grupy badaczy z Harvardu, opracowujących modele ludzkiego języka dla systemów uczenia maszynowego. Interfejs użytkownika został maksymalnie uproszczony i wymaga jedynie podania pliku wejściowego z tekstem oraz pliku do zapisania wyniku tłumaczenia. System rozszerzeń umożliwia wdrażanie dodatkowej funkcjonalności na bazie OpenNMT, takiej jak autorefereowanie, klasyfikacja tekstów i generowanie napisów.
Zastosowanie TensorFlow pozwala wykorzystać możliwości GPU (w celu przyspieszenia procesu uczenia się sieci neuronowej). Aby uprościć dystrybucję produktu, projekt rozwija także samodzielną wersję tłumacza w języku C++ — CTranslate2, który korzysta z wcześniej wytrenowanych modeli bez uzależnienia od dodatkowych zależności.
W nowej wersji dodano parametr initial_learning_rate i wdrożono kilka nowych argumentów (mha_bias i output_layer_bias) do konfiguracji generatora modeli Transformer. Poza tym wprowadzono poprawki błędów.
Źródło: opennet.ru
