Le projet llama.cpp a publié la compilation b10326, qui modifie le calcul des mesures de temps en incluant le passage du vocoder.
- La mise à jour garantit que `get_output` exécute le travail de forme d'onde différé par le pipeline, en le mesurant depuis une seule fenêtre finale jusqu'à un passage complet selon le modèle.
- Ce changement maintient la précision du temps total rapporté et du ratio audio-vers-traitement.
- Les binaires sont disponibles pour macOS (Apple Silicon et Intel), iOS, Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows (CPU, OpenCL, CUDA 12/13, Vulkan, OpenVINO, SYCL, HIP) et openEuler.
La modification améliore l'honnêteté des métriques de performance en s'assurant que les frais généraux de traitement audio sont correctement pris en compte dans les temps rapportés.