U publikua versioni i sistemës së hapur të sintetikës së zërit RHVoice 1.8.0, e cila fillimisht u zhvillua për të siguruar mbështetje cilësore për gjuhën ruse, por më pas u adaptua edhe për gjuhë të tjera, përfshirë anglishten, portugezen, ukrainishten, kirgizishten, tatarishten dhe gjeorgjishten. Kodi është shkruar në C++ dhe shpërndahet nën licencën LGPL 2.1. Mbështetet funksionimi në GNU/Linux, Windows dhe Android. Programi është i pajtueshëm me ndërfaqet standarde TTS (text-to-speech) për konvertimin e tekstit në të folur: SAPI5 (Windows), Speech Dispatcher (GNU/Linux) dhe Android Text-To-Speech API, por gjithashtu mund të përdoret në lexuesin e ekranit NVDA. Krijuesja dhe zhvilluesja kryesore e RHVoice është Olga Yakovleva, e cila vazhdon projektin pavarësisht verbërisë totale.
NĂ« versionin 1.8 pĂ«r platformĂ«n Android Ă«shtĂ« propozuar njĂ« sistem i ri pĂ«r menaxhimin e tĂ« dhĂ«nave tĂ« zĂ«rit dhe gjuhĂ«s, duke lejuar shkarkimin e pĂ«rditĂ«simeve tĂ« tĂ« dhĂ«nave tĂ« zĂ«rit pa pĂ«rditĂ«suar aplikacionin mobil. Kontrolli pĂ«r shfaqjen e pĂ«rditĂ«simeve tĂ« tĂ« dhĂ«nave pĂ«r zĂ«rat dhe gjuhĂ«t e shtuar bĂ«het automatikisht. PĂ«r mĂ« tepĂ«r, nĂ« kĂ«tĂ« version tĂ« ri Ă«shtĂ« implementuar mbĂ«shtetje pĂ«r gjuhĂ«n polake dhe Ă«shtĂ« shtuar njĂ« zĂ« i ri pĂ«r gjuhĂ«n maqedonase. ĂshtĂ« siguruar pajtueshmĂ«ria me versionet e reja alfa dhe beta tĂ« lexuesit tĂ« ekranit NVDA. JanĂ« eliminuar problemet me ndĂ«rtimin nĂ« platformĂ«n Linux qĂ« ndodhnin nĂ« mungesĂ« tĂ« Speech Dispatcher.
TĂ« kujtojmĂ« se nĂ« RHVoice janĂ« pĂ«rdorur zhvillimet e projektit HTS (Sistemi pĂ«r Sintetizimin e ZĂ«rit HMM/DNN) dhe metoda parametrike e sintetikĂ«s me modele statistike (Sintetizimi Parametrik Statistikor mbi bazĂ«n e HMM â Modeli i Markovit tĂ« Fshehur). Avantazhi i modelit statistik Ă«shtĂ« kostot e ulta dhe kĂ«rkesat e pakta pĂ«r fuqinĂ« e CPU-sĂ«. TĂ« gjitha operacionet kryhen lokal nĂ« sistemin e pĂ«rdoruesit. MbĂ«shteten tre nivele cilĂ«sie tĂ« zĂ«rit (sa mĂ« e ulĂ«t tĂ« jetĂ« cilĂ«sia, aq mĂ« e lartĂ« Ă«shtĂ« performanca dhe mĂ« e vogĂ«l Ă«shtĂ« koha e reagimit).
Një nga disavantazhet e modelit statistik është cilësia e ulët e shqiptimit, e cila nuk arrin nivelin e sintetizatorëve që gjenerojnë zë me kombinim të fragmenteve të zërit natyror. Megjithatë, rezultati është mjaft i qartë dhe përngjan me transmetimin e një regjistrimi nga një megafon. Si krahasim, projekti Silero, i cili ofron një motor të hapur për sintetizimin e zërit duke përdorur teknologji të mësimit të makinave dhe një grup modelesh për gjuhën ruse, është më i mirë se RHVoice në cilësi.
PĂ«r gjuhĂ«n ruse janĂ« tĂ« disponueshme 14 variante zĂ«rash, ndĂ«rsa pĂ«r anglishten â 6. ZĂ«rat formohen mbi bazĂ«n e regjistrimeve tĂ« thĂ«nies natyrale. NĂ« cilĂ«simet mund tĂ« ndryshoni shpejtĂ«sinĂ«, lartĂ«sinĂ« dhe volumet. PĂ«r tĂ« ndryshuar ritmin mund tĂ« pĂ«rdoret biblioteka Sonic. ĂshtĂ« e mundur identifikimi automatik dhe kalimi i gjuhĂ«s nĂ« bazĂ« tĂ« analizĂ«s sĂ« tekstit hyrĂ«s (pĂ«r shembull, pĂ«r fjalĂ« dhe citate nĂ« njĂ« gjuhĂ« tjetĂ«r mund tĂ« pĂ«rdoret modeli i sintetikĂ«s sĂ« zĂ«rit natyror pĂ«r kĂ«tĂ« gjuhĂ«). MbĂ«shteten profilĂ«t e zĂ«rit qĂ« pĂ«rcaktojnĂ« kombinimet e zĂ«rave pĂ«r gjuhĂ« tĂ« ndryshme.
Burimi: opennet.ru
