Le 6 janvier, la version 1.7.4 d'un système de reconnaissance vocale haute performance a été publiée. whisper.cpp, mettant en œuvre le modèle Whisper développé par OpenAI, écrit en C et C++ et distribué sous licence MIT.
Le projet utilise une bibliothèque de tenseurs propriétaire pour l'apprentissage automatique GGML, écrite en C et optimisée pour utiliser divers backends (CUDA, Vulkan, BLAS, SYCL, OpenCL, etc.).
Liste des changements :
- Renommage des fichiers exécutables :
main -> whisper-cli bench -> whisper-bench stream -> whisper-stream command -> whisper-command server -> whisper-server talk-llama -> whisper-talk-llama
- Les exemples talk et talk.wasm ont été supprimés.
- Une option de suppression des lexèmes non verbaux a été ajoutée au whisper-server.
- Le paramètre suppress_non_speech_tokens a été renommé en suppress_nst.
- Une option no_speech_thold a été ajoutée à l'API et aux utilitaires pour définir la probabilité d'absence de discours au niveau du segment lors de la transcription.
- Une option —suppress_nst a été ajoutée au whisper-cli.
- Le 30 mai, la version de l'outil en ligne de commande
Source : linux.org.ru
