Proyek llama.cpp merilis versi b10937, yang memperluas aturan penyesuaian baris noshuffle OpenCL ke format kuantisasi q4_K, q5_K, dan q8_0. Sebelumnya, aturan penyesuaian ini hanya diterapkan pada q6_K.
- Perubahan ini mengatasi kompatibilitas OpenCL untuk jenis kuantisasi tertentu.
- Biner disediakan untuk macOS (Apple Silicon dan Intel), Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows (CPU, CUDA, Vulkan, OpenVINO, SYCL, ROCm), dan openEuler.
- XCFramework iOS dan build UI juga disertakan dalam rilis ini.