Kjo është lëshuar sistemi i hapur i sinthezës së zërit RHVoice 1.6.0, fillimisht i zhvilluar për të siguruar mbështetje cilësore për gjuhën ruse, por pastaj i adaptohet edhe për gjuhë të tjera, përfshirë anglishten, portugezen, ukrainashten, kirgizishten, tataren dhe gjeorgjianen. Kodi është shkruar në C++ dhe përhapet nën licencën LGPL 2.1. Mbështetet puna në GNU/Linux, Windows dhe Android. Programi është i pajtueshëm me ndërfaqet tipike TTS (text-to-speech) për transformimin e tekstit në zë: SAPI5 (Windows), Speech Dispatcher (GNU/Linux) dhe Android Text-To-Speech API, por gjithashtu mund të përdoret në lexuesin e ekranit NVDA. Krijuesi dhe zhvilluesi kryesor i RHVoice është Olga Yakovleva, e cila e zhvillon projektin pavarësisht verbërisë së plotë.
NĂ« versionin e ri janĂ« shtuar 5 variante tĂ« reja zĂ«rash pĂ«r gjuhĂ«n ruse. ĂshtĂ« realizuar mbĂ«shtetje pĂ«r gjuhĂ«n shqipe. Kushtezimi i fjalorit pĂ«r gjuhĂ«n ukrainase Ă«shtĂ« pĂ«rmirĂ«suar. MbĂ«shtetje e zgjeruar pĂ«r zĂ«dhĂ«nien e simboleve emoji. ĂshtĂ« punuar pĂ«r tĂ« eliminuar defektet nĂ« aplikacionin pĂ«r platformĂ«n Android, Ă«shtĂ« thjeshtuar importimi i fjalorĂ«ve tĂ« pĂ«rdoruesve, si dhe Ă«shtĂ« shtuar mbĂ«shtetje pĂ«r platformĂ«n Android 11. NĂ« bĂ«rthamĂ«n e motorit janĂ« shtuar cilĂ«sime dhe funksionalitete tĂ« reja, duke pĂ«rfshirĂ« g2p.case, word_break dhe mbĂ«shtetje pĂ«r filtrin e ekualizimit.
KujtojmĂ« se nĂ« RHVoice pĂ«rdoren arritjet e projektit HTS (HMM/DNN-based Speech Synthesis System) dhe metoda parametrike e sintezĂ«s me modele statistikore (Statistical Parametric Synthesis mbi bazĂ«n e HMM â Hidden Markov Model). Avantazhi i modelit statistik Ă«shtĂ« shpenzimi i ulĂ«t dhe pak kĂ«rkesat pĂ«r fuqinĂ« e CPU-sĂ«. TĂ« gjitha operacionet kryhen lokal nĂ« sistemin e pĂ«rdoruesit. MbĂ«shteten tri nivele tĂ« cilĂ«sisĂ« sĂ« zĂ«rit (sa mĂ« e ulĂ«t tĂ« jetĂ« cilĂ«sia, aq mĂ« e lartĂ« Ă«shtĂ« performanca dhe mĂ« e shkurtĂ«r koha e reagimit).
Disavantazhi i modelit statistik është cilësia relativisht e ulët e shqipimit, e cila nuk arrin nivelin e sintezatorëve që gjenerojnë zë nga kombinimi i fragmenteve të zërit natyror, por megjithatë rezultati është mjaft i qartë dhe ngjan me transmetimin e një regjistrimi me altoparlant. Për krahasim, projekti Silero, që ofron një motor të hapur për sintezën e zërit mbi bazën e teknologjive të mësimit të makinerive dhe një grup modelesh për gjuhën ruse, e tejkalon cilësinë e RHVoice.
PĂ«r gjuhĂ«n ruse janĂ« tĂ« disponueshme 13 variante zĂ«rash, ndĂ«rsa pĂ«r anglishten â 5. ZĂ«rat formohen mbi baza tĂ« regjistrimeve tĂ« zĂ«rit natyror. NĂ« cilĂ«sime mund tĂ« ndryshohet shpejtĂ«sia, lartĂ«sia dhe volumi. PĂ«r tĂ« ndryshuar ritmin mund tĂ« pĂ«rdoret biblioteka Sonic. Mund tĂ« bĂ«het pĂ«rcaktimi automatike dhe ndĂ«rrimi i gjuhĂ«s mbi bazĂ«n e analizĂ«s sĂ« tekstit hyrĂ«s (pĂ«r shembull, pĂ«r fjalĂ«t dhe citatet nĂ« njĂ« gjuhĂ« tjetĂ«r mund tĂ« pĂ«rdoret modeli origjinal i sinthezĂ«s pĂ«r atĂ« gjuhĂ«). MbĂ«shteten profilet e zĂ«rit, qĂ« pĂ«rcaktojnĂ« kombinimet e zĂ«rave pĂ«r gjuhĂ« tĂ« ndryshme.
Burimi: opennet.ru
