Google publikoi kodek-un audio Lyra për transmetimin e zërit në kushte të dobëta lidhjeje.

Kompania Google prezantoi njĂ« kodek tĂ« ri audio, Lyra, i optimizuar pĂ«r tĂ« arritur cilĂ«si maksimale nĂ« transmetimin e zĂ«rit, madje edhe kur pĂ«rdoren kanale komunikimi shumĂ« tĂ« ngadalta. Kodi i zbatimit tĂ« Lyra Ă«shtĂ« shkruar nĂ« C++ dhe Ă«shtĂ« i hapur nĂ«n licencĂ«n Apache 2.0, por nĂ« mesin e varĂ«sive tĂ« nevojshme pĂ«r funksionimin e tij Ă«shtĂ« njĂ« bibliotekĂ« pronĂ«sore, libsparse_inference.so, e cila implementon bĂ«rthamĂ«n pĂ«r llogaritje matematikore. ShĂ«nohet se biblioteka pronĂ«sore Ă«shtĂ« pĂ«rkohĂ«sore — nĂ« tĂ« ardhmen, Google premton tĂ« zhvillojĂ« njĂ« zĂ«vendĂ«sim tĂ« hapur dhe tĂ« sigurojĂ« mbĂ«shtetje pĂ«r platforma tĂ« ndryshme.

Në aspektin e cilësisë së të dhënave të zërit të transmetuara në shpejtësi të ulëta, Lyra e tejkalon ndjeshëm kodekët tradicionalë që përdorin metoda të përpunimit digjital të sinjaleve. Për të arritur një cilësi të lartë të transmetimit të zërit në kushte për një volum të kufizuar të informacionit të transmetuar, përveç metodave të zakonshme të kompresimit të zërit dhe transformimit të sinjaleve, në Lyra përdoret një model fjalimi i bazuar në një sistem të mësimit të makinerisë, që lejon rikrijimin e informacionit të munguar mbi bazën e karakteristikave tipike të fjalës. Modeli i angazhuar për gjenerimin e zërit është trajnuar duke përdorur disa mijëra orë regjistrimesh zëri në më shumë se 70 gjuhë.

Google publikoi kodek-un audio Lyra për transmetimin e zërit në kushte të dobëta lidhjeje.

Kodi përfshin një kodues dhe një dekodues. Algoritmi i punës së koduesit konsiston në nxjerrjen e parametrave të të dhënave audio çdo 40 milisekonda, kompresimin e tyre dhe dërgimin e tyre tek marrësi përmes rrjetit. Për të transmetuar të dhënat, mjafton një kanal komunikimi me shpejtësi 3 kilobit në sekondë. Parametrat audio të nxjerrë përfshijnë spektrogramet mel-logaritmike, që marrin parasysh karakteristikat e energjisë së zërit në gamat e ndryshme të frekuencës dhe janë përgatitur duke marrë parasysh modelin e perceptimit të dëgjimit të njeriut.

Google publikoi kodek-un audio Lyra për transmetimin e zërit në kushte të dobëta lidhjeje.

Dekoduesi përdor një model gjenerativ, i cili, në bazë të parametrave audio të dërguar, rikrijon sinjalin me zë. Për të reduktuar kompleksitetin e llogaritjeve, është aplikuar një model i lehtë i bazuar në një rrjet nervor rekurent, që përfaqëson një variant të modelit të sintezës së zërit WaveRNN, në të cilin përdoret një frekuencë më e ulët e mostrave, por gjithashtu gjenerohen paralelisht disa sinjale në gamë të ndryshme frekuencash. Sinjalet e marra pastaj mbivendosen për të marrë një sinjal të vetëm të daljes, që i përgjigjet frekuencës së caktuar të diskretizimit.

Përshpejtimi gjithashtu përfshin instrukcione të specializuara të procesorëve, të disponueshme në procesorët 64-bit ARM. Si rezultat, pavarësisht përdorimit të mësimit makinerik, kodeku Lyra mund të përdoret për kodimin dhe dekodimin e zërit në kohë reale në smartphone-t e nivelit të mesëm, duke treguar një vonesë të transmetimit të sinjalit prej 90 milisekondash.

Burimi: opennet.ru

Bleni hostim tĂ« besueshĂ«m pĂ«r faqe me mbrojtje nga DDoS, serverĂ« VPS VDS đŸ”„ Bleni hostim tĂ« besueshĂ«m pĂ«r faqe me mbrojtje nga DDoS, serverĂ« VPS VDS | ProHoster