Das Unternehmen Google hat die Version 1.3 des Audiocodecs Lyra veröffentlicht, die darauf abzielt, eine hohe Sprachübertragungsqualität unter Bedingungen mit begrenzter Datenübertragung zu erreichen. Die Sprachqualität bei Bitraten von 3,2 kbps, 6 kbps und 9,2 kbps unter Verwendung des Codecs Lyra entspricht ungefähr den Bitraten von 10 kbps, 13 kbps und 14 kbps bei Verwendung des Codecs Opus. Zur Lösung der gestellten Aufgabe wird neben den üblichen Methoden zur Audio-Kompression und Signalverarbeitung ein Sprachmodell auf Basis des maschinellen Lernens in Lyra eingesetzt, das es ermöglicht, fehlende Informationen auf der Grundlage typischer Sprachmerkmale zu rekonstruieren. Die Referenzimplementierung des Codes ist in C++ geschrieben und wird unter der Lizenz Apache 2.0 verteilt.
Im Gegensatz zur im Oktober vorgestellten grundlegend überarbeiteten Version Lyra 1.2, die auf eine neue Architektur des neuronalen Netzwerks umgestellt wurde, wurde in Version 1.3 das Modell des maschinellen Lernens ohne architektonische Änderungen optimiert. In der neuen Version werden zur Speicherung der Gewichte und zur Durchführung arithmetischer Operationen anstelle von 32-Bit-Gleitkommazahlen 8-Bit-Ganzzahlen verwendet, was zu einer Reduzierung der Modellgröße um 43 % und einer Beschleunigung der Modellverarbeitung um 20 % bei Tests auf dem Smartphone Pixel 6 Pro führte. Die Sprachqualität konnte dabei auf demselben Niveau gehalten werden, allerdings wurde das Format der übertragenen Daten geändert und ist nicht mit früheren Versionen kompatibel.
Quelle: opennet.ru
