Google ha pubblicato un aggiornamento per il codec audio Lyra 0.0.2, ottimizzato per garantire la massima qualità della trasmissione vocale su canali di comunicazione molto lenti. Il codec è stato reso pubblico all'inizio di aprile, ma veniva fornito insieme a una biblioteca matematica proprietaria. Nella versione 0.0.2, questo problema è stato risolto e per la biblioteca in questione è stata creata una sostituzione open source — sparse_matmul, che, come il codec stesso, è distribuita sotto la licenza Apache 2.0. Tra le altre migliorie, si segnala la possibilità di utilizzare il sistema di build Bazel con il compilatore GCC e l'uso predefinito di questo accoppiamento su Linux invece di Bazel+Clang.
Ricordiamo che la qualità dei dati vocali trasmessi a basse velocità con Lyra supera significativamente quella dei tradizionali codec, che utilizzano metodi di elaborazione del segnale digitale. Per ottenere un'alta qualità nella trasmissione della voce in condizioni di volume di dati limitato, oltre ai consueti metodi di compressione audio e di elaborazione dei segnali, Lyra utilizza un modello di riconoscimento vocale basato su un sistema di apprendimento automatico, capace di ricreare le informazioni mancanti sulla base delle caratteristiche tipiche della voce. Il modello utilizzato per generare il suono è stato addestrato con migliaia di ore di registrazioni vocali in oltre 70 lingue. Le prestazioni della soluzione proposta sono sufficienti per codificare e decodificare la voce in tempo reale su smartphone di fascia media, con un ritardo di trasmissione del segnale di circa 90 millisecondi.
Fonte: opennet.ru
