Después de más de cinco meses de desarrollo, se lanzó la versión 1.7.0 de un sistema de reconocimiento de voz automático de alto rendimiento. whisper.cpp, implementando el modelo Whisper de OpenAI en los lenguajes C y C++ y distribuido bajo la licencia MIT.
El proyecto utiliza una biblioteca de tensores de aprendizaje automático GGML, escrita en lenguaje C.
Principales cambios:
- se han solucionado fallos con un gran número de rayos (beams);
- se ha reducido el uso total de VRAM;
- se ha optimizado el rendimiento del codificador.
Fuente: linux.org.ru
