Proyek llama.cpp telah merilis versi b11097, yang memperkenalkan kernel biner OpenCL untuk format A8 Q4_0 non-MoE dp4a.

  • Pembaruan ini menambahkan dukungan untuk format kuantisasi spesifik A8 Q4_0 melalui kernel dp4a baru.
  • Biner disediakan untuk macOS (Apple Silicon dan Intel), Linux (CPU, Vulkan, CUDA 12/13, ROCm 10.0, OpenVINO, SYCL), Windows (CPU, Vulkan, CUDA 12/13, ROCm 10.0, OpenVINO, SYCL), Android, dan openEuler.
  • XCFramework untuk iOS dan build UI mandiri juga disertakan dalam aset rilis.