Proyek llama.cpp merilis versi b10657, memperkenalkan kernel biner OpenCL baru untuk model ahli campuran. Secara khusus, pembaruan ini menambahkan `kernel_gemm_moe_q4_0_q8_1_dp4a_bin` dan `kernel_gemm_moe_mxfp4_q8_1_dp4a_bin` untuk mendukung komputasi efisien pada perangkat keras yang kompatibel.

  • Menambahkan kernel biner OpenCL untuk GEMO MOE dengan kuantisasi q4_0/q8_1 dan mxfp4/q8_1.
  • Menyediakan biner untuk macOS (Apple Silicon dan Intel), iOS, Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Windows (CPU, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm), Android, dan openEuler.
  • Dukungan KleidiAI pada Apple Silicon macOS tetap dinonaktifkan dalam rilis ini.

Pembaruan ini memperluas kompatibilitas perangkat keras untuk model ahli campuran dengan mengaktifkan implementasi kernel OpenCL tertentu.