La compañía Google ha publicado la versión 1.3 del códec de audio Lyra, diseñado para lograr una alta calidad en la transmisión de voz bajo condiciones de ancho de banda limitado. La calidad de voz a tasas de bits de 3.2 kbps, 6 kbps y 9.2 kbps utilizando el códec Lyra es aproximadamente comparable a las tasas de bits de 10 kbps, 13 kbps y 14 kbps al usar el códec Opus. Para abordar este desafío, además de los métodos convencionales de compresión de audio y procesamiento de señales, Lyra utiliza un modelo de voz basado en sistemas de aprendizaje automático para reconstruir la información faltante en función de características típicas del habla. La implementación de referencia está escrita en C++ y se distribuye bajo la licencia Apache 2.0.
A diferencia de la versión 1.2 rediseñada radicalmente lanzada en octubre, que fue trasladada a una nueva arquitectura de red neuronal, la versión 1.3 ha optimizado el modelo de aprendizaje automático sin cambios arquitectónicos. En esta nueva versión, para almacenar los pesos y realizar operaciones aritméticas, se utilizan enteros de 8 bits en lugar de números de punto flotante de 32 bits, lo que ha reducido el tamaño del modelo en un 43% y acelerado su funcionamiento en un 20% durante las pruebas en el smartphone Pixel 6 Pro. La calidad de la voz se ha mantenido al mismo nivel, aunque el formato de los datos transmitidos ha cambiado y no es compatible con versiones anteriores.
Fuente: opennet.ru
