Pe 6 ianuarie a fost lansată versiunea 1.7.4 a sistemului de recunoaștere automată a vorbirii de înaltă performanță whisper.cpp, care implementează modelul Whisper de la OpenAI, scris în limbajele C și C++ și distribuit sub licența MIT.
Proiectul utilizează o bibliotecă proprietară de tensori pentru machine learning GGML, scrisă în limbajul C și optimizată pentru utilizarea diverselor backend-uri (CUDA, Vulkan, BLAS, SYCL, OpenCL etc.).
Lista modificărilor:
- Renomirea fișierelor executabile:
main -> whisper-cli bench -> whisper-bench stream -> whisper-stream command -> whisper-command server -> whisper-server talk-llama -> whisper-talk-llama
- Au fost eliminate exemplele talk și talk.wasm.
- În whisper-server a fost adăugată opțiunea de suprimare a lexemelor non-vorbire.
- Parametrul suppress_non_speech_tokens a fost redenumit în suppress_nst.
- În API și utilități a fost adăugată opțiunea no_speech_thold pentru a stabili probabilitatea absenței vorbirii la nivel de segment în timpul transcrierii.
- În whisper-cli a fost adăugată opțiunea —suppress_nst.
- Alte îmbunătățiri și corecții de erori.
Sursa: linux.org.ru
