Le projet llama.cpp a publié la version b11101, qui inclut une correction du système de compilation permettant des appels répétés à find_package pour la bibliothèque llama.

  • cmake : autoriser les appels répétés à find_package pour llama (PR #29228)
  • Binaires macOS/iOS fournis pour Apple Silicon (arm64), Intel (x64) et iOS XCFramework ; le support de KleidiAI est désactivé.
  • Binaires Linux disponibles pour Ubuntu x64, arm64 et s390x sur les backends CPU, Vulkan, CUDA 12/13, ROCm 10.0, OpenVINO, SYCL et Snapdragon.
  • Binaires Android arm64 publiés pour le CPU et Snapdragon (CPU, GPU Adreno, NPU Hexagon).
  • Binaires Windows fournis pour les CPUs x64 et arm64, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL et ROCm 10.0.
  • Le support d'openEuler est largement désactivé, seules des configurations spécifiques 310p et 910b (ACL Graph) étant listées.

Cette version fournit des binaires mis à jour pour une large gamme d'accélérateurs matériels et de systèmes d'exploitation, ainsi que la correction cmake.