Google heeft de release van de audiocodec Lyra 1.3 gepubliceerd, gericht op het bereiken van hoge kwaliteit in spraakoverdracht onder beperkte gegevensoverdracht. De spraakkwaliteit bij bitrates van 3,2 kbps, 6 kbps en 9,2 kbps met de Lyra-codec komt ongeveer overeen met bitrates van 10 kbps, 13 kbps en 14 kbps met de Opus-codec. Om deze uitdaging aan te gaan, maakt Lyra gebruik van een spraakmodel op basis van een machine learning-systeem, dat in staat is om ontbrekende informatie te reconstrueren op basis van typische spraakkenmerken. De referentie-implementatie is geschreven in C++ en wordt verspreid onder de Apache 2.0-licentie.
In tegenstelling tot de drastisch herwerkte release van Lyra 1.2, die in oktober werd gepresenteerd en op een nieuwe neurale netwerkarchitectuur is overgeschakeld, is in versie 1.3 de machine learning-model geoptimaliseerd zonder architecturale veranderingen. In de nieuwe versie worden in plaats van 32-bits drijvende komma getallen 8-bits gehele getallen gebruikt voor het opslaan van gewichten en uitvoeren van rekenkundige bewerkingen, wat heeft geleid tot een modelgroottevermindering van 43% en een versnelling van de modelwerking met 20% bij testen op de Pixel 6 Pro smartphone. De spraakkwaliteit is daarbij op hetzelfde niveau behouden, maar het formaat van de verzonden gegevens is gewijzigd en niet compatibel met eerdere versies.
Bron: opennet.ru
