El Grupo de Empresas CRT, que forma parte del ecosistema de Sberbank, ha anunciado el desarrollo de una avanzada plataforma de síntesis de voz, que según se afirma, garantiza fluidez y expresividad en la lectura de cualquier texto.
La solución presentada es la tercera generación del sistema de síntesis de voz. Un audio de alta calidad se genera mediante complejos modelos de redes neuronales. Los desarrolladores afirman que el resultado de estos algoritmos es la síntesis de voz en ruso más realista.

La plataforma incluye un módulo de predicción de acentos en palabras que aún no están en el diccionario base. Además, se ha previsto la corrección automática de errores ortográficos comunes. Gracias a un análisis lingüístico profundo del texto, la pronunciación se ajustará a las normas del idioma incluso en casos complejos.
Otra ventaja de la plataforma es que no requiere costosos servidores, equipados con aceleradores GPU. La tecnología se puede utilizar de dos maneras: a través de un servicio en la nube o integrándola en una solución propia.

Entre las posibles áreas de aplicación de la solución se mencionan chatbots y asistentes de voz, servicios de información y notificación, servicios de voz con síntesis instantánea de cualquier texto durante la llamada, etc.
«En escenarios automatizados de comunicación con los clientes, la tecnología permite interactuar de manera individual con cada abonado, ya que no hay mensajes fijos, y cualquier texto puede ser sintetizado durante la llamada», dicen los desarrolladores.
Se puede probar la tecnología .
Fuente: 3dnews.ru
