Le projet llama.cpp a publié la version b10505, qui introduit une nouvelle option de préréglage `dedup-cache-models` pour le composant serveur.
- La release inclut des binaires pour macOS (Apple Silicon et Intel), Linux (Ubuntu x64, arm64, s390x, Vulkan, OpenVINO, SYCL), Android, Windows (CPU, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm) et openEuler.
- Le support KleidiAI pour macOS Apple Silicon est désactivé dans cette build.
- Le support Ubuntu x64 ROCm 7.14 est également désactivé.
- Un nouveau package d'interface utilisateur est disponible au téléchargement avec les binaires spécifiques à la plateforme.