Le projet llama.cpp a publié la compilation b10198, qui introduit le support des opérations de concaténation quantifiée dans le backend Vulkan.
- La mise à jour technique principale est l'ajout du support Vulkan pour la concat quantifiée, implémentée dans la pull request #25684.
- Les compilations macOS Apple Silicon avec KleidiAI sont explicitement désactivées dans cette version.
- Des binaires sont fournis pour plusieurs plateformes, y compris macOS (Apple Silicon et Intel), Linux (Ubuntu x64, arm64, s390x), Windows (CPU, CUDA 12/13, Vulkan, ROCm, OpenVINO, SYCL, HIP), Android et openEuler.
- Un binaire UI autonome est également inclus dans le package de release.