Le projet llama.cpp a publié la compilation b11158, qui inclut un ajustement du support des matrices coopératives KHR spécifiquement pour les GPU Adreno via le backend Vulkan.
- Support des matrices coopératives (coopmat) activé pour le backend Vulkan afin d'améliorer les performances sur le matériel compatible.
- Correction de la fonction mul_mat_s au sein de l'implémentation.
- Suppression des instructions de débogage du code source.
Cette mise à jour fournit une accélération GPU optimisée pour les appareils Snapdragon exécutant Linux et Android, ainsi que pour les systèmes Windows arm64 avec des graphiques Adreno.