A fost publicată versiunea 1.2.4 a sistemului de sinteză vocală deschis RHVoice, inițial dezvoltat pentru a oferi suport de calitate pentru limba rusă, dar ulterior adaptat și pentru alte limbi, inclusiv engleză, portugheză, ucraineană, kirghiză, tătară și georgiană. Codul este scris în C++ și este distribuit sub licența LGPL 2.1. Este suportat pe GNU/Linux, Windows și Android. Programul este compatibil cu interfețele TTS standard (text-to-speech) pentru conversia textului în vocalizare: SAPI5 (Windows), Speech Dispatcher (GNU/Linux) și Android Text-To-Speech API, dar poate fi utilizat și în cititorul de ecran NVDA.
Programul utilizează o metodă parametrică de sinteză cu modele statistice (Statistical Parametric Synthesis bazate pe HMM - Modelul Markov Ascuns). Un avantaj al modelului statistic este consumul redus de resurse și cerințele scăzute de putere a CPU. Toate operațiile se desfășoară local pe sistemul utilizatorului. Sunt suportate trei niveluri de calitate a vocii (cu cât calitatea este mai mică, cu atât performanța este mai mare și timpul de reacție mai scurt).
Se suportă personalizarea și schimbarea vocilor. Pentru limba rusă sunt disponibile 9 variante de voci, iar pentru engleză - 5. Vocile sunt generate pe baza înregistrărilor discursului natural. Datorită utilizării modelului statistic, calitatea pronunției nu atinge nivelul sinteticelor care generează vocea pe baza combinației de fragmente de discurs natural, cu toate acestea rezultatul este suficient de clar și amintește de o transmisie de înregistrare printr-un difuzor.
În setările programului pot fi ajustate viteza, tonalitatea și volumul. Pentru modificarea tempo-ului poate fi utilizată biblioteca Sonic. Este posibilă detectarea automată și comutarea limbii pe baza analizei textului de intrare (de exemplu, pentru cuvinte și citate în altă limbă poate fi utilizat modelul de sinteză nativ pentru acea limbă). Se suportă profile vocale care definesc combinații de voci pentru diferite limbi.
Sursa: opennet.ro
