Il 17 e il 19 giugno si sono svolti i rilasci delle versioni 1.9.0 e 1.9.1 del sistema di riconoscimento vocale ad alte prestazioni whisper.cpp, che implementa il modello Whisper di OpenAI, basato sulla libreria tensoriale di apprendimento automatico GGML e sul formato binario GGUF.
Viene fornita la libreria libwhisper, esempi dimostrativi e utilità da console: whisper-bench, whisper-cli, whisper-command, whisper-lsp, whisper-quantize, whisper-server, whisper-stream, whisper-vad-speech-segments, parakeet-cli e parakeet-quantize.
I progetti sono scritti in C e C++ e sono distribuiti con licenza MIT.
Novità:
- È stata aggiunta l'utilità da console parakeet-cli, che supporta il modello NVIDIA Parakeet;
- , è stata aggiunta anche la supporto per NVIDIA Parakeet nel wrapper Ruby.
Alcuni cambiamenti importanti sono stati effettuati nelle versioni intermedie dalla notizia whisper.cpp 1.8.0:
- gestione delle eccezioni C++ nella funzione whisper_init_with_params_no_state;
- Il supporto per ffmpeg è stato completamente riscritto (senza utilizzare codice GPL proveniente dagli esempi di ffmpeg) e l'utilizzo di ffmpeg in whisper.cpp è stato affinato;
- nell'utilità whisper-cli è stata aggiunta l'opzione —version per visualizzare la versione.
Fonte: linux.org.ru




