Firma Google opublikowała wersję kodeka audio Lyra 1.3, który ma na celu osiągnięcie wysokiej jakości przesyłania głosu przy ograniczonej ilości przesyłanych informacji. Jakość mowy przy bitrate'ach 3,2 kbps, 6 kbps i 9,2 kbps z użyciem kodeka Lyra odpowiada mniej więcej bitrate'om 10 kbps, 13 kbps i 14 kbps przy użyciu kodeka Opus. W celu rozwiązania postawionego zadania, oprócz standardowych metod kompresji dźwięku i przetwarzania sygnałów, w Lyra zastosowano model mowy oparty na systemie uczenia maszynowego, który pozwala na rekonstrukcję brakujących informacji na podstawie typowych cech mowy. Referencyjna implementacja kodu napisana jest w C++ i jest udostępniana na licencji Apache 2.0.
W przeciwieństwie do radykalnie przeprojektowanej wersji Lyra 1.2 z października, która została przeniesiona na nową architekturę sieci neuronowej, w wersji 1.3 przeprowadzono optymalizację modelu uczenia maszynowego bez zmian architektonicznych. W nowej wersji, do przechowywania wag i wykonywania operacji arytmetycznych zamiast 32-bitowych liczb zmiennoprzecinkowych wykorzystano 8-bitowe liczby całkowite, co doprowadziło do zmniejszenia rozmiaru modelu o 43% oraz zwiększenia wydajności modelu o 20% podczas testowania na smartfonie Pixel 6 Pro. Jakość mowy pozostała na tym samym poziomie, jednak format przesyłanych danych uległ zmianie i nie jest kompatybilny z poprzednimi wersjami.
Źródło: opennet.ru
