Le projet llama.cpp a publié la compilation b10568, qui met à jour la gestion des modèles pour utiliser la fonction `ggml_rope_set_offset()`. Ce changement est partiellement appliqué pour prendre en charge DeepSeek 2.

  • La version inclut des binaires pour macOS (Apple Silicon et Intel), Linux (Ubuntu x64, arm64, s390x), Windows, Android et openEuler.
  • Les backends pris en charge incluent CPU, Vulkan, ROCm 7.14, OpenVINO, SYCL, CUDA 12/13 et OpenCL Adreno.
  • macOS Apple Silicon avec KleidiAI et Ubuntu x64 avec ROCm 7.14 sont actuellement désactivés dans cette compilation.