Le projet llama.cpp a publié la version b10354, qui inclut une correction pour le masque d'affinité CPU ignoré sur les appareils Android.

  • La release fournit des binaires pour macOS (Apple Silicon et Intel), iOS, Linux (Ubuntu x64, arm64, s390x), Windows (CPU, CUDA 12/13, Vulkan, OpenCL, ROCm, SYCL, OpenVINO) et Android (arm64).
  • Le support de KleidiAI pour macOS Apple Silicon reste désactivé dans cette build.
  • Les builds openEuler sont largement désactivés, seules des configurations spécifiques x86 et aarch64 étant disponibles.