Proyek llama.cpp merilis versi b10937, yang memperluas aturan penyesuaian baris noshuffle OpenCL ke format kuantisasi q4_K, q5_K, dan q8_0. Sebelumnya, aturan penyesuaian ini hanya diterapkan pada q6_K.

  • Perubahan ini mengatasi kompatibilitas OpenCL untuk jenis kuantisasi tertentu.
  • Biner disediakan untuk macOS (Apple Silicon dan Intel), Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows (CPU, CUDA, Vulkan, OpenVINO, SYCL, ROCm), dan openEuler.
  • XCFramework iOS dan build UI juga disertakan dalam rilis ini.