È stata pubblicata la versione 0.28.0 del sistema di traduzione automatica OpenNMT (Open Neural Machine Translation), che utilizza metodi di apprendimento automatico. Per la costruzione della rete neurale, il progetto sfrutta le potenzialità della libreria di deep learning TensorFlow. Il codice dei moduli sviluppati dal progetto OpenNMT è scritto in Python e distribuito sotto licenza MIT. I modelli pronti sono stati preparati per le lingue inglese, tedesca e catalana; per le altre lingue, è possibile creare autonomamente un modello utilizzando il set di dati del progetto OPUS (per addestrare il sistema vengono forniti due file: uno con le frasi nella lingua sorgente e l'altro con la traduzione di alta qualità di queste frasi nella lingua di destinazione).
Il progetto si sviluppa con la partecipazione della società SYSTRAN, specializzata nella creazione di strumenti di traduzione automatica, e di un gruppo di ricercatori di Harvard che sviluppano modelli linguistici per i sistemi di apprendimento automatico. L'interfaccia utente è massimamente semplificata e richiede solo l'indicazione del file di input con il testo e del file per salvare il risultato della traduzione. Il sistema di estensioni consente di implementare funzionalità aggiuntive basate su OpenNMT, come l'autoreferenziazione, la classificazione dei testi e la generazione di sottotitoli.
L'uso di TensorFlow consente di sfruttare le capacità della GPU (per accelerare il processo di addestramento della rete neurale). Per semplificare la distribuzione del prodotto, il progetto sta sviluppando anche una versione autonoma del traduttore in linguaggio C++ — CTranslate2, che utilizza modelli preaddestrati senza dipendenze aggiuntive.
Nella nuova versione è stato aggiunto il parametro initial_learning_rate e sono stati implementati diversi nuovi argomenti (mha_bias e output_layer_bias) per configurare il generatore di modelli Transformer. Inoltre, sono stati apportati dei correttivi bug.
Fonte: opennet.ru
