Le projet llama.cpp a publié la compilation b10759, qui inclut une correction pour éviter l'initialisation du type de tampon KleidiAI lors de la distribution.
- La version fournit des binaires pour macOS (Apple Silicon et Intel), iOS, Linux (Ubuntu x64, arm64, s390x), Windows (CPU, CUDA 12/13, Vulkan, OpenCL, ROCm, SYCL, OpenVINO), Android et openEuler.
- Le support de KleidiAI est explicitement désactivé pour macOS Apple Silicon dans cette compilation.
- Des aperçus pour Windows arm64 avec CUDA 13 sont inclus aux côtés des versions standard de CUDA 12.4 et 13.3.