Lëshimi i sistemit të hapur të sintezës së zërit RHVoice 1.6.0, fillimisht i zhvilluar për të siguruar mbështetje cilësore për gjuhën ruse, por më pas i adaptuar edhe për gjuhë të tjera, përfshirë anglishten, portugezin, ukrainishten, kirgizishten, tatarishten dhe gjeorgjishten. Kodi është shkruar në C++ dhe distribuonhet nën licencën LGPL 2.1. Mbështetet puna në GNU/Linux, Windows dhe Android. Programi është i pajtueshëm me standartet e zakonshme TTS (text-to-speech) për konvertimin e tekstit në zë: SAPI5 (Windows), Speech Dispatcher (GNU/Linux) dhe Android Text-To-Speech API, por mund të përdoret gjithashtu në lexuesin e ekranit NVDA. Krijuesja dhe zhvilluesja kryesore e RHVoice është Olga Yakovleva, e cila vazhdon të zhvillojë projektin pavarësisht nga verbëria e plotë.
NĂ« versionin e ri janĂ« shtuar 5 variante tĂ« reja zĂ«ri pĂ«r tĂ« folurimin rus. ĂshtĂ« realizuar mbĂ«shtetje pĂ«r gjuhĂ«n shqipe. Fjalori pĂ«r gjuhĂ«n ukrainase Ă«shtĂ« pĂ«rditĂ«suar. MbĂ«shtetje pĂ«r shqiptime tĂ« simboleve emoji Ă«shtĂ« zgjeruar. JanĂ« bĂ«rĂ« pĂ«rmirĂ«sime pĂ«r tĂ« eliminuar gabimet nĂ« aplikacionin pĂ«r platformĂ«n Android, importimi i fjalorĂ«ve individual Ă«shtĂ« thjeshtuar, dhe Ă«shtĂ« shtuar mbĂ«shtetje pĂ«r platformĂ«n Android 11. NĂ« bĂ«rthamĂ«n e motorit janĂ« shtuar cilĂ«sime dhe funksionalitete tĂ« reja, duke pĂ«rfshirĂ« g2p.case, word_break dhe mbĂ«shtetje pĂ«r filtre ekuilizimi.
TĂ« kujtojmĂ« se nĂ« RHVoice janĂ« pĂ«rdorur zhvillimet e projektit HTS (Sistemi pĂ«r Sintetizimin e ZĂ«rit HMM/DNN) dhe metoda parametrike e sintetikĂ«s me modele statistike (Sintetizimi Parametrik Statistikor mbi bazĂ«n e HMM â Modeli i Markovit tĂ« Fshehur). Avantazhi i modelit statistik Ă«shtĂ« kostot e ulta dhe kĂ«rkesat e pakta pĂ«r fuqinĂ« e CPU-sĂ«. TĂ« gjitha operacionet kryhen lokal nĂ« sistemin e pĂ«rdoruesit. MbĂ«shteten tre nivele cilĂ«sie tĂ« zĂ«rit (sa mĂ« e ulĂ«t tĂ« jetĂ« cilĂ«sia, aq mĂ« e lartĂ« Ă«shtĂ« performanca dhe mĂ« e vogĂ«l Ă«shtĂ« koha e reagimit).
Një nga disavantazhet e modelit statistik është cilësia e ulët e shqiptimit, e cila nuk arrin nivelin e sintetizatorëve që gjenerojnë zë me kombinim të fragmenteve të zërit natyror. Megjithatë, rezultati është mjaft i qartë dhe përngjan me transmetimin e një regjistrimi nga një megafon. Si krahasim, projekti Silero, i cili ofron një motor të hapur për sintetizimin e zërit duke përdorur teknologji të mësimit të makinave dhe një grup modelesh për gjuhën ruse, është më i mirë se RHVoice në cilësi.
PĂ«r gjuhĂ«n ruse janĂ« nĂ« dispozicion 13 variante tĂ« zĂ«rit, ndĂ«rsa pĂ«r anglishten â 5. ZĂ«rat formohen mbi bazĂ«n e regjistrimeve tĂ« zĂ«rit natyror. NĂ« cilĂ«simet mund tĂ« ndryshoni shpejtĂ«sinĂ«, lartĂ«sinĂ« dhe volumet. Biblioteka Sonic mund tĂ« pĂ«rdoret pĂ«r ndryshimin e ritmit. Ka mundĂ«si pĂ«r identifikimin dhe kalimin automatik tĂ« gjuhĂ«s bazuar nĂ« analizĂ«n e teksit hyrĂ«s (pĂ«r shembuj, pĂ«r fjalĂ« dhe citate nĂ« njĂ« gjuhĂ« tjetĂ«r mund tĂ« pĂ«rdoret modeli i sintetikĂ«s pĂ«rkatĂ«s pĂ«r kĂ«tĂ« gjuhĂ«). PĂ«rkrahim profilet e zĂ«rit, qĂ« pĂ«rcaktojnĂ« kombinimet e zĂ«ra pĂ«r gjuhĂ« tĂ« ndryshme.
Burimi: opennet.ru
