Proyek llama.cpp telah merilis build b10889, yang mencakup optimasi memori untuk menghindari alokasi cache V untuk indexer karena tidak digunakan.
Pembaruan ini menyediakan binaris pra-bangun untuk macOS (Apple Silicon dan Intel), iOS, Linux (Ubuntu x64, arm64, s390x dengan CPU, Vulkan, ROCm 10.0, OpenVINO, dan backend SYCL), Android (arm64), Windows (CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm 10.0), dan openEuler.
Rilis ini juga mencakup UI llama.cpp.