Le projet llama.cpp a publié la version b10505, qui introduit une nouvelle option de préréglage `dedup-cache-models` pour le composant serveur.

  • La release inclut des binaires pour macOS (Apple Silicon et Intel), Linux (Ubuntu x64, arm64, s390x, Vulkan, OpenVINO, SYCL), Android, Windows (CPU, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm) et openEuler.
  • Le support KleidiAI pour macOS Apple Silicon est désactivé dans cette build.
  • Le support Ubuntu x64 ROCm 7.14 est également désactivé.
  • Un nouveau package d'interface utilisateur est disponible au téléchargement avec les binaires spécifiques à la plateforme.