Le projet llama.cpp a publié la version b10539, qui résout un problème critique de stabilité numérique dans le backend Vulkan tout en élargissant le support matériel pour les utilisateurs de Windows.
- Vulkan FA MMQ utilise désormais fp32 pour les calculs de quantification Q afin d'éviter les débordements lorsque qd est un denorm.
- Ajout des binaires Windows x64 pour CUDA 13 et du support preview pour Windows arm64 avec CUDA 13.4.
- Inclut les builds pour Ubuntu s390x (CPU), macOS Intel (x64) et iOS XCFramework.
- Le support OpenCL Adreno est désormais disponible pour Windows arm64.
Cette mise à jour garantit des performances fiables sur les appareils Vulkan en prévenant les erreurs arithmétiques et fournit aux utilisateurs les dernières options de compatibilité CUDA 13.