Proyek llama.cpp telah merilis versi b10505, yang memperkenalkan opsi preset `dedup-cache-models` baru untuk komponen server.

  • Rilis ini mencakup biner untuk macOS (Apple Silicon dan Intel), Linux (Ubuntu x64, arm64, s390x, Vulkan, OpenVINO, SYCL), Android, Windows (CPU, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm), dan openEuler.
  • Dukungan KleidiAI untuk macOS Apple Silicon dinonaktifkan dalam build ini.
  • Dukungan Ubuntu x64 ROCm 7.14 juga dinonaktifkan.
  • Paket UI baru tersedia untuk diunduh bersama dengan biner spesifik platform.