La compañía Mozilla, dentro del proyecto ha comenzado a crear un sistema de traducción automática que funcione en el navegador. El proyecto permitirá integrar en Firefox un motor de traducción autónomo que no recurra a servicios externos en la nube y procese los datos exclusivamente en el sistema del usuario. El principal objetivo de este desarrollo es garantizar la privacidad y proteger los datos del usuario de posibles filtraciones durante la traducción del contenido de las páginas abiertas en el navegador.
El desarrollo de Bergamot se lleva a cabo en la oficina de Mozilla en Berlín con la participación de investigadores de universidades del Reino Unido, Estonia y Chequia. El desarrollo es financiado por la Unión Europea bajo una subvención obtenida a través del programa . La cuantía de la subvención es de tres millones de euros. El proyecto está previsto para tres años. En Mozilla para un especialista en sistemas de aprendizaje automático que participe en el desarrollo de un motor para la traducción de un idioma a otro.
Entre los desarrollos relacionados con el proyecto Bergamot, :
- el marco de traducción automática desarrollado en la Universidad de Edimburgo , construido sobre la base de una red neuronal recurrente. El marco está escrito en C++, puede utilizar GPU para acelerar el aprendizaje y la traducción, y bajo licencia MIT.
- la herramienta creada en la Universidad de Praga para procesar información en lenguaje natural utilizando métodos de aprendizaje automático secuencial. El proyecto aplica el marco TensorFlow y puede usarse para crear prototipos rápidos de sistemas de traducción automática y clasificación de información en lenguaje natural. El código está disponible bajo la licencia BSD.
- El proyecto preparado en la Universidad de Sheffield , utilizado para evaluar y predecir la calidad de los sistemas de traducción automática.
- Los desarrollos en Mozilla () y ()
- El proyecto financiado por la Unión Europea , que acumula una base de traducciones simultáneas de diversas frases en diferentes idiomas, que se pueden usar para entrenar sistemas de aprendizaje automático. La base del proyecto es un bot , que indexa sitios web multilingües y encuentra automáticamente textos idénticos presentados en varios idiomas. La base de ejemplos de traducciones paralelas se está formando para 24 idiomas, incluido el ruso ( para el idioma ruso ocupa 637MB en formato comprimido e incluye más de 12 millones de ejemplos de traducción).
El desarrollo de Bergamot comenzó en enero de este año, pero los avances del proyecto aún para pruebas públicas. Sin embargo, hace unos días los desarrolladores publicaron un video que demuestra el prototipo inicial.

Recordemos que en Firefox ya existe un mecanismo integrado para traducir páginas, pero depende del uso de servicios en la nube externos (se admiten Google, Yandex y Bing) y no está activado por defecto (para habilitarlo en about:config hay que cambiar la configuración de «browser.translation»). Este mecanismo de traducción también admite la detección automática del idioma al abrir una página en un idioma desconocido, mostrando un indicador especial que sugiere realizar la traducción de la página. El prototipo del sistema de traducción desarrollado en el marco del proyecto Bergamot utiliza esta misma interfaz para interactuar con el usuario, pero en lugar de llamar a servicios externos, se activa un procesador interno.
Fuente: opennet.ru
