Google publikoi kodekun audio Lyra për transmetimin e zërit në kushte të dobëta të lidhjes

Kompania Google prezantoi njĂ« kodek tĂ« ri audio, Lyra, i optimizuar pĂ«r tĂ« arritur cilĂ«sinĂ« maksimale tĂ« transmetimit tĂ« zĂ«rit edhe nĂ« kanale shumĂ« tĂ« ngadalta tĂ« komunikimit. Kodi i realizimit tĂ« Lyra Ă«shtĂ« i shkruar nĂ« C++ dhe Ă«shtĂ« i hapur nĂ«n licencĂ«n Apache 2.0, por mes varĂ«sive tĂ« nevojshme pĂ«r funksionim Ă«shtĂ« prezent njĂ« bibliotekĂ« proprietare libsparse_inference.so me implementimin e bĂ«rthamĂ«s pĂ«r llogaritje matematikore. Vlen tĂ« pĂ«rmendet se biblioteka proprietare Ă«shtĂ« pĂ«rkohshme – nĂ« tĂ« ardhmen, Google premton tĂ« zhvillojĂ« njĂ« zĂ«vendĂ«sim tĂ« hapur dhe tĂ« sigurojĂ« mbĂ«shtetje pĂ«r platforma tĂ« ndryshme.

Në cilësinë e të dhënave të zërit të transmetuara në shpejtësi të ulta, Lyra tejkalon ndjeshëm kodekët tradicionalë, të cilët përdorin metoda të përpunimit të sinjaleve digjitale. Për të arritur cilësi të lartë të transmetimit të zërit në kushte të kufizuara të informacionit të transmetuar, përveç metodave standarde të kompresimit të zërit dhe transformimit të sinjaleve, në Lyra aplikohet një model zëri mbi bazën e një sistemi të mësimit të makinerive, që lejon rimarrjen e informacionit të munguar mbi bazën e karakteristikave tipike të zërit. Modeli i angazhuar për gjenerimin e zërit është mësuar duke përdorur disa mijëra orë regjistrimesh të zërit në më shumë se 70 gjuhë.

Google publikoi kodekun audio Lyra për transmetimin e zërit në kushte të dobëta të lidhjes

Kodeku përfshin një kodues dhe një dekodues. Algoritmi i funksionimit të koduesit konsiston në nxjerrjen e parametrave të të dhënave të zërit çdo 40 milisekonda, kompresimin e tyre dhe dërgimin e tyre tek marrësi përmes rrjetit. Për të transmetuar të dhënat, mjafton një kanal komunikimi me shpejtësi 3 kilobit në sekondë. Parametrat e zërit të nxjerra përfshijnë mel-spektrogramet logaritmike, të cilat marrin parasysh karakteristikat e energjisë së zërit në frekuenca të ndryshme dhe janë përgatitur duke marrë në konsideratë modelin e perceptimit njerëzor të dëgjimit.

Google publikoi kodekun audio Lyra për transmetimin e zërit në kushte të dobëta të lidhjes

Dekoderi përdor një model gjenerativ, i cili, bazuar në parametrat e dhënë të zërit, ri-krijon sinjalin me zë. Për të reduktuar kompleksitetin e llogaritjeve, është aplikuar një model i lehtë i bazuar në një rrjet nervor të rikthyer, i cili është një variant i modelit të sintezës së zërit WaveRNN, ku përdoret një frekuencë më e ulët e mostrave, por gjenerohen paralelisht disa sinjale në frekuenca të ndryshme. Sinjalet e marra më pas përfshihen për të marrë një sinjal të vetëm dalje, që korrespondon me frekuencën e kërkuar të diskriminimit.

Për të shpejtuar gjithashtu janë përdorur instruksione të specializuara për procesorin, të disponueshme në procesorët 64-bit ARM. Si rezultat, pavarësisht nga përdorimi i mësimit makinerik, kodeku Lyra mund të përdoret për kodimin dhe dekodimin e zërit në kohë reale në smartphone me çmime mesatare, duke demonstruar një vonesë të transmetimit të sinjalit në nivelin e 90 milisekondave.

Burimi: opennet.ru

Blini hosting tĂ« besueshĂ«m pĂ«r faqe interneti me mbrojtje nga DDoS, serverĂ« VPS VDS đŸ”„ Blini hosting tĂ« besueshĂ«m pĂ«r faqe interneti me mbrojtje nga DDoS, serverĂ« VPS VDS | ProHoster