6 stycznia wypuszczono wersję 1.7.4 wysokowydajnego systemu automatycznego rozpoznawania mowy whisper.cpp, realizującego model Whisper od OpenAI, napisanego w językach C i C++ oraz rozpowszechnianego na licencji MIT.
W projekcie wykorzystano autorską bibliotekę tensorową do uczenia maszynowego, GGML, napisane w języku C i zoptymalizowane do wykorzystania różnych backendów (CUDA, Vulkan, BLAS, SYCL, OpenCL i inne).
Lista zmian:
- Zmiany nazw plików wykonywalnych:
main -> whisper-cli bench -> whisper-bench stream -> whisper-stream command -> whisper-command server -> whisper-server talk-llama -> whisper-talk-llama
- Usunięto przykłady talk i talk.wasm.
- Do whisper-server dodano opcję tłumienia nie słownych tokenów.
- Parametr suppress_non_speech_tokens został zmieniony na suppress_nst.
- W API i narzędziach dodano opcję no_speech_thold do określania prawdopodobieństwa braku mowy na poziomie segmentu podczas transkrypcji.
- W whisper-cli dodano opcję —suppress_nst.
- Inne ulepszenia i poprawki błędów.
Źródło: linux.org.ru
