Proyek llama.cpp merilis versi b10922, memperkenalkan kernel biner OpenCL baru untuk perkalian matriks non-MoE A8 Q4_K. Pembaruan ini juga mencakup perbaikan kompatibilitas tata letak dan penamaan ulang pembantu pemilihan kernel biner di dalam basis kode.

  • Menambahkan kernel OpenCL `kernel_gemm_noshuffle_q4_k_f32_32b_trans_ila_a8_bin`.
  • Memperbaiki masalah kompatibilitas tata letak di backend OpenCL.
  • Menamai ulang pembantu pemilihan kernel biner untuk kejelasan.

Rilis ini menyediakan biner yang diperbarui untuk macOS, Linux, Windows, Android, dan iOS di berbagai backend perangkat keras, termasuk CPU, CUDA, Vulkan, ROCm, dan SYCL.