Më 6 janar u publikua versioni 1.7.4 i një sistemi të avancuar për njohjen automatike të zërit whisper.cpp, duke realizuar modelin Whisper nga OpenAI, e shkruar në gjuhët C dhe C++ dhe e shpërndarë nën licencën MIT.
Projektin e përdor një bibliotekë unike tenzorësh për mësimin e makinerisë GGML, e shkruar në gjuhën C dhe e optimizuar për përdorimin e backend-eve të ndryshme (CUDA, Vulkan, BLAS, SYCL, OpenCL etj.).
Lista e ndryshimeve:
- Riinventimi i skedarëve ekzekutivë:
main -> whisper-cli bench -> whisper-bench stream -> whisper-stream command -> whisper-command server -> whisper-server talk-llama -> whisper-talk-llama
- Hequr shembujt talk dhe talk.wasm.
- Në whisper-server është shtuar një opsion për të shtypur leksemat jo të folura.
- Parametri suppress_non_speech_tokens është riemëruar në suppress_nst.
- Në API dhe utilitetet është shtuar opsioni no_speech_thold për të caktuar probabilitetin e mungesës së zërit në nivelin e segmentit gjatë transkripcionit.
- NĂ« whisper-cli Ă«shtĂ« shtuar opsioni âsuppress_nst.
- Përmirësime dhe korrigjime të tjera të defekteve.
Burimi: linux.org.ru
