Il 17 e il 19 giugno sono stati rilasciati le versioni 1.9.0 e 1.9.1 del sistema ad alte prestazioni per il riconoscimento vocale automatico whisper.cpp, che implementa il modello Whisper di OpenAI, basato sulla libreria tensoriale per l'apprendimento automatico GGML e nel formato binario GGUF.
È fornita la libreria libwhisper, esempi dimostrativi e utilità da console: whisper-bench, whisper-cli, whisper-command, whisper-lsp, whisper-quantize, whisper-server, whisper-stream, whisper-vad-speech-segments, parakeet-cli e parakeet-quantize.
I progetti sono scritti in C e C++ e distribuiti con licenza MIT.
Modifiche:
- È stata aggiunta l'utilità da console parakeet-cli, che supporta il modello NVIDIA Parakeet;
- nel wrapper Ruby è stata anche aggiunta la supporto a NVIDIA Parakeet.
Alcuni cambiamenti significativi sono stati apportati nel nelle versioni intermedie dall'ultima notizia whisper.cpp 1.8.0:
- gestione delle eccezioni in C++ nella funzione whisper_init_with_params_no_state;
- il supporto per ffmpeg è stato completamente riscritto (senza utilizzare codice GPL preso dagli esempi di ffmpeg) e l'utilizzo di ffmpeg in whisper.cpp è stato specificato meglio;
- nell'utilità whisper-cli è stata aggiunta l'opzione —version per visualizzare la versione.
Fonte: linux.org.ru




