Google ha rilasciato un aggiornamento del codec audio Lyra 0.0.2, ottimizzato per garantire la massima qualità nella trasmissione della voce anche su canali di comunicazione molto lenti. Il codec è stato introdotto all'inizio di aprile, ma era fornito in associazione a una biblioteca matematica proprietaria. Nella versione 0.0.2, questo problema è stato risolto e per la suddetta biblioteca è stata creata una sostituzione open-source — sparse_matmul, che, come il codec stesso, è distribuita sotto licenza Apache 2.0. Tra gli altri miglioramenti, si segnala la possibilità di utilizzare il sistema di build Bazel con il compilatore GCC e di usare tale combinazione come predefinita su Linux anziché Bazel+Clang.
Ricordiamo che per la qualità dei dati vocali trasmessi a basse velocità, Lyra supera di gran lunga i tradizionali codec che utilizzano metodi di elaborazione digitale del segnale. Per ottenere un'elevata qualità nella trasmissione della voce in condizioni di limitata quantità di dati, oltre ai metodi di compressione audio e di conversione dei segnali, in Lyra viene utilizzato un modello di riconoscimento vocale basato su un sistema di machine learning, che permette di ricreare le informazioni mancanti sulla base delle caratteristiche tipiche della voce. Il modello utilizzato per generare il suono è stato addestrato utilizzando diverse migliaia di ore di registrazioni vocali in oltre 70 lingue. Le prestazioni dell'implementazione proposta sono sufficienti per codificare e decodificare la voce in tempo reale su smartphone di fascia media, con un ritardo di trasmissione del segnale di circa 90 millisecondi.
Fonte: opennet.ru
