Proyek llama.cpp merilis versi b10930, yang mencakup perbaikan untuk komponen server agar memungkinkan unduhan model bahkan ketika pengguna telah mencapai batas model mereka.
- Menyelesaikan issue #26809 dengan mengaktifkan unduhan pada batas (PR #28530).
- Menyediakan biner untuk macOS Apple Silicon dan Intel, iOS, Ubuntu x64/arm64/s390x, Android arm64, Windows x64/arm64, dan openEuler.
- Mendukung berbagai backend perangkat keras termasuk CPU, Vulkan, ROCm 10.0, OpenVINO, SYCL FP32/FP16, CUDA 12/13, dan OpenCL Adreno.
Pembaruan ini memastikan fungsionalitas berkelanjutan bagi pengguna yang mencapai kuota penyimpanan sambil menyediakan dukungan platform yang luas.