Lanzamiento del sintetizador de voz RHVoice 1.2.4, desarrollado para el idioma ruso

Se ha publicado la versión del sistema de síntesis de voz de código abierto RHVoice 1.2.4, que se desarrolló originalmente para proporcionar un soporte de calidad para el idioma ruso, pero que luego se adaptó también para otros idiomas, incluyendo inglés, portugués, ucraniano, kirguís, tártaro y georgiano. El código está escrito en C++ y se distribuye bajo la licencia LGPL 2.1. Se soporta su funcionamiento en GNU/Linux, Windows y Android. El programa es compatible con interfaces TTS estándar (text-to-speech) para convertir texto a voz: SAPI5 (Windows), Speech Dispatcher (GNU/Linux) y Android Text-To-Speech API, pero también puede utilizarse en el lector de pantalla NVDA.

El programa utiliza un método de síntesis paramétrica con modelos estadísticos (Statistical Parametric Synthesis basado en HMM — Hidden Markov Model). La ventaja del modelo estadístico es su bajo costo computacional y su bajo requerimiento de potencia de CPU. Todas las operaciones se realizan localmente en el sistema del usuario. Se soportan tres niveles de calidad de voz (cuanto menor es la calidad, mayor es el rendimiento y menor es el tiempo de respuesta).

Se admite la configuración y cambio de voces. Para el idioma ruso están disponibles 9 variantes de voces, y para el inglés — 5. Las voces se forman a partir de grabaciones de habla natural. Debido al uso del modelo estadístico, la calidad de pronunciación no alcanza el nivel de los sintetizadores que generan voz a partir de la combinación de fragmentos de habla natural, pero, sin embargo, el resultado es bastante comprensible y recuerda a la transmisión de una grabación a través de un altavoz.

En la configuración se pueden modificar la velocidad, tono y volumen. Se puede aplicar la biblioteca Sonic para cambiar el tempo. Es posible la detección automática y el cambio de idioma basado en el análisis del texto de entrada (por ejemplo, se puede usar un modelo de síntesis nativo del idioma para palabras y citas en otro idioma). Se soportan perfiles de voz que determinan combinaciones de voces para diferentes idiomas.

Fuente: opennet.ru

Compra un hosting fiable para sitios web con protección contra DDoS, servidores VPS VDS 🔥 Compra un hosting fiable para sitios web con protección contra DDoS, servidores VPS VDS | ProHoster