Se ha publicado la versión 0.28.0 del sistema de traducción automática OpenNMT (Traducción Automática de Redes Neuronales), que utiliza métodos de aprendizaje automático. Para construir la red neuronal, el proyecto utiliza las capacidades de la biblioteca de aprendizaje profundo TensorFlow. El código de los módulos desarrollados por el proyecto OpenNMT está escrito en Python y se distribuye bajo la licencia MIT. Se han preparado modelos listos para los idiomas inglés, alemán y catalán; para los demás idiomas, se puede crear un modelo de forma independiente basado en el conjunto de datos del proyecto OPUS (para entrenar el sistema se proporcionan dos archivos: uno con oraciones en el idioma de origen y el segundo con la traducción de esas oraciones en el idioma objetivo).
El proyecto avanza con la participación de la empresa SYSTRAN, especializada en la creación de herramientas de traducción automática, y un grupo de investigadores de Harvard, que desarrollan modelos de lenguaje humano para sistemas de aprendizaje automático. La interfaz de usuario está simplificada al máximo y solo requiere indicar el archivo de entrada con el texto y el archivo para guardar el resultado de la traducción. El sistema de extensiones permite implementar funcionalidades adicionales sobre OpenNMT, como auto-referencias, clasificación de textos y generación de subtítulos.
El uso de TensorFlow permite aprovechar las capacidades de la GPU (para acelerar el proceso de entrenamiento de la red neuronal). Para simplificar la distribución del producto, el proyecto también desarrolla una versión autónoma del traductor en C++ — CTranslate2, que utiliza modelos previamente entrenados sin vínculos a dependencias adicionales.
En la nueva versión se ha añadido el parámetro initial_learning_rate y se han implementado varios nuevos argumentos (mha_bias y output_layer_bias) para la configuración del generador de modelos Transformer. Por lo demás, se han realizado correcciones de errores.
Fuente: opennet.ru
