Google ha publicado la actualización del códec de audio Lyra 0.0.2, optimizado para lograr la máxima calidad de transmisión de voz al usar canales de comunicación muy lentos. El códec se lanzó a principios de abril, pero venía vinculado a una biblioteca matemática propietaria. En la versión 0.0.2, esta limitación ha sido solucionada y se ha creado una sustitución abierta para la biblioteca mencionada — sparse_matmul, que al igual que el códec en sí se distribuye bajo la licencia Apache 2.0. Entre otras mejoras, se destaca la posibilidad de utilizar el sistema de construcción Bazel con el compilador GCC, y el uso de esta combinación por defecto en Linux en lugar de Bazel+Clang.
Cabe recordar que en términos de calidad de los datos de voz transmitidos a bajas velocidades, Lyra supera significativamente a los códecs tradicionales que utilizan métodos de procesamiento de señales digitales. Para lograr una alta calidad en la transmisión de voz en condiciones de un volumen limitado de información transmitida, además de los métodos de compresión de sonido y conversión de señales habituales, Lyra utiliza un modelo de lenguaje basado en un sistema de aprendizaje automático que permite recrear la información que falta basándose en características típicas de la voz. El modelo utilizado para la generación de sonido ha sido entrenado con miles de horas de grabaciones de voces en más de 70 idiomas. La eficiencia de la implementación propuesta es suficiente para codificar y decodificar voz en tiempo real en smartphones de gama media, con un retraso de transmisión de señal de alrededor de 90 milisegundos.
Fuente: opennet.ru
