Firma Google udostępniła brakujące kody źródłowe dla kodeka audio Lyra

Google opublikował aktualizację kodeka audio Lyra 0.0.2, zoptymalizowanego pod kątem uzyskania maksymalnej jakości transmisji mowy przy wykorzystaniu bardzo wolnych kanałów łączności. Kodek został udostępniony na początku kwietnia, ale był powiązany z własnościową biblioteką matematyczną. W wersji 0.0.2 tę wadę usunięto i przygotowano otwarty zamiennik dla wskazanej biblioteki — sparse_matmul, który podobnie jak sam kodek jest rozpowszechniany na licencji Apache 2.0. Wśród innych usprawnień warto wymienić możliwość użycia systemu budowania Bazel z kompilatorem GCC oraz wykorzystanie tego zestawu domyślnie w Linuksie zamiast Bazel+Clang.

Przypomnijmy, że pod względem jakości przesyłanych danych głosowych przy niskich przepływnościach Lyra wyraźnie przewyższa tradycyjne kodeki wykorzystujące metody cyfrowego przetwarzania sygnałów. Aby osiągnąć wysoką jakość transmisji głosu przy ograniczonej ilości przesyłanych danych, oprócz standardowych metod kompresji dźwięku i przekształcania sygnałów, w Lyrze stosowany jest model mowy oparty na systemie uczenia maszynowego, który pozwala odtworzyć brakujące informacje na podstawie typowych cech mowy. Model używany do generowania dźwięku został wytrenowany z wykorzystaniem kilku tysięcy godzin nagrań głosowych w ponad 70 językach. Wydajność zaproponowanej implementacji jest wystarczająca do kodowania i dekodowania mowy w czasie rzeczywistym na smartfonach ze średniej półki cenowej, z opóźnieniem transmisji sygnału na poziomie 90 milisekund.

Źródło: opennet.ru

Kup niezawodny hosting stron z ochroną DDoS, serwery VPS VDS 🔥 Kup niezawodny hosting stron z ochroną DDoS, serwery VPS VDS - ProHoster