Lëshimi i versionit të hapur të sistemit të sintezës së zërit RHVoice 1.8.0, i cili fillimisht u zhvillua për të ofruar mbështetje cilësore për gjuhën ruse, por më pas u adaptua edhe për gjuhë të tjera, duke përfshirë anglishten, portugezishten, ukrainishten, kirgize, tatarishten dhe gjeorgjianishten. Kodi është shkruar në C++ dhe shpërndahet nën licencën LGPL 2.1. Mbështetet funksionimi në GNU/Linux, Windows dhe Android. Programi është i përputhshëm me ndërfaqet standarde TTS (text-to-speech) për konvertimin e tekstit në folje: SAPI5 (Windows), Speech Dispatcher (GNU/Linux) dhe Android Text-To-Speech API, por gjithashtu mund të përdoret në leximin e ekranit NVDA. Krijuesi dhe zhvilluesi kryesor i RHVoice është Olga Yakovleva, e cila zhvillon projektin pavarësisht verbërisë së saj të plotë.
NĂ« versionin 1.8 pĂ«r platformĂ«n Android Ă«shtĂ« propozuar njĂ« sistem i ri pĂ«r menaxhimin e tĂ« dhĂ«nave tĂ« zĂ«rit dhe gjuhĂ«ve, qĂ« lejon shkarkimin e azhurnimeve tĂ« tĂ« dhĂ«nave tĂ« zĂ«rit pa e rinovuar aplikacionin mobil. Kontrolli i shfaqjes sĂ« azhurnimeve tĂ« tĂ« dhĂ«nave pĂ«r zĂ«ra dhe gjuhĂ« tĂ« shtuar bĂ«het automatikisht. PĂ«r mĂ« tepĂ«r, nĂ« kĂ«tĂ« lĂ«shim tĂ« ri Ă«shtĂ« realizuar mbĂ«shtetje pĂ«r gjuhĂ«n polake dhe Ă«shtĂ« shtuar njĂ« zĂ« i ri pĂ«r gjuhĂ«n maqedonase. ĂshtĂ« garantuar pĂ«rputhshmĂ«ria me versionet e reja alfa dhe beta tĂ« lexuesit tĂ« ekranit NVDA. JanĂ« eliminuar problemet e ndĂ«rtimit nĂ« platformĂ«n Linux, tĂ« cilat ndodhnin nĂ« mungesĂ« tĂ« Speech Dispatcher.
KujtojmĂ« se nĂ« RHVoice pĂ«rdoren arritjet e projektit HTS (HMM/DNN-based Speech Synthesis System) dhe metoda parametrike e sintezĂ«s me modele statistikore (Statistical Parametric Synthesis mbi bazĂ«n e HMM â Hidden Markov Model). Avantazhi i modelit statistik Ă«shtĂ« shpenzimi i ulĂ«t dhe pak kĂ«rkesat pĂ«r fuqinĂ« e CPU-sĂ«. TĂ« gjitha operacionet kryhen lokal nĂ« sistemin e pĂ«rdoruesit. MbĂ«shteten tri nivele tĂ« cilĂ«sisĂ« sĂ« zĂ«rit (sa mĂ« e ulĂ«t tĂ« jetĂ« cilĂ«sia, aq mĂ« e lartĂ« Ă«shtĂ« performanca dhe mĂ« e shkurtĂ«r koha e reagimit).
Disavantazhi i modelit statistik është cilësia relativisht e ulët e shqipimit, e cila nuk arrin nivelin e sintezatorëve që gjenerojnë zë nga kombinimi i fragmenteve të zërit natyror, por megjithatë rezultati është mjaft i qartë dhe ngjan me transmetimin e një regjistrimi me altoparlant. Për krahasim, projekti Silero, që ofron një motor të hapur për sintezën e zërit mbi bazën e teknologjive të mësimit të makinerive dhe një grup modelesh për gjuhën ruse, e tejkalon cilësinë e RHVoice.
PĂ«r gjuhĂ«n ruse janĂ« tĂ« disponueshme 14 variante zĂ«rash, ndĂ«rsa pĂ«r anglishten - 6. ZĂ«rat formohen bazuar nĂ« regjistrime tĂ« fjalĂ«ve natyrale. NĂ« cilĂ«simet mund tĂ« ndryshohet shpejtĂ«sia, lartĂ«sia dhe volumi. PĂ«r ndryshimin e tempit mund tĂ« pĂ«rdoret biblioteqa Sonic. ĂshtĂ« e mundur pĂ«rcaktimi dhe ndĂ«rrimi automatik i gjuhĂ«s nĂ« bazĂ« tĂ« analizĂ«s sĂ« tekstin hyrĂ«s (pĂ«r shembull, pĂ«r fjalĂ«t dhe citatet nĂ« njĂ« gjuhĂ« tjetĂ«r mund tĂ« pĂ«rdoret modeli i sintetikĂ«s natyrore pĂ«r kĂ«tĂ« gjuhĂ«). MbĂ«shteten profilet e zĂ«rit, qĂ« pĂ«rcaktojnĂ« kombinimet e zĂ«rave pĂ«r gjuhĂ« tĂ« ndryshme.
Burimi: opennet.ru
