Proyek llama.cpp telah merilis versi b10505, yang memperkenalkan opsi preset `dedup-cache-models` baru untuk komponen server.
- Rilis ini mencakup biner untuk macOS (Apple Silicon dan Intel), Linux (Ubuntu x64, arm64, s390x, Vulkan, OpenVINO, SYCL), Android, Windows (CPU, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm), dan openEuler.
- Dukungan KleidiAI untuk macOS Apple Silicon dinonaktifkan dalam build ini.
- Dukungan Ubuntu x64 ROCm 7.14 juga dinonaktifkan.
- Paket UI baru tersedia untuk diunduh bersama dengan biner spesifik platform.