Proyek llama.cpp telah merilis versi b11042, yang memperkenalkan kernel biner OpenCL baru untuk model A8 Q6_K non-MoE. Pembaruan ini juga mencakup perbaikan kompatibilitas tata letak di dalam backend OpenCL.

  • Menambahkan kernel OpenCL `kernel_gemm_noshuffle_q6_k_f32_32b_trans_ila_a8_bin`.
  • Memecahkan masalah kompatibilitas tata letak dalam implementasi OpenCL.
  • Menyediakan biner untuk macOS (Apple Silicon dan Intel), iOS, Linux (CPU, Vulkan, CUDA 12/13, ROCm, OpenVINO, SYCL), Android, Windows (CPU, Vulkan, CUDA 12/13, ROCm, OpenVINO, SYCL), dan openEuler.

Rilis ini memperluas dukungan perangkat keras untuk format kuantisasi tertentu pada perangkat OpenCL sambil mempertahankan kompatibilitas luas di seluruh sistem operasi utama dan arsitektur GPU.