Le projet llama.cpp a publié la compilation b11158, qui inclut un ajustement du support des matrices coopératives KHR spécifiquement pour les GPU Adreno via le backend Vulkan.

  • Support des matrices coopératives (coopmat) activé pour le backend Vulkan afin d'améliorer les performances sur le matériel compatible.
  • Correction de la fonction mul_mat_s au sein de l'implémentation.
  • Suppression des instructions de débogage du code source.

Cette mise à jour fournit une accélération GPU optimisée pour les appareils Snapdragon exécutant Linux et Android, ainsi que pour les systèmes Windows arm64 avec des graphiques Adreno.