Proyek llama.cpp telah merilis build b10198, yang memperkenalkan dukungan untuk operasi concatenasi kuantisasi di dalam backend Vulkan.
- Pembaruan teknis utama adalah penambahan dukungan Vulkan untuk concat kuantisasi, yang diimplementasikan dalam pull request #25684.
- Build macOS Apple Silicon dengan KleidiAI secara eksplisit dinonaktifkan dalam rilis ini.
- Binari disediakan untuk berbagai platform termasuk macOS (Apple Silicon dan Intel), Linux (Ubuntu x64, arm64, s390x), Windows (CPU, CUDA 12/13, Vulkan, ROCm, OpenVINO, SYCL, HIP), Android, dan openEuler.
- Binari UI mandiri juga disertakan dalam paket rilis.