Proyek llama.cpp telah menambahkan kernel biner A8 Q8_0 non-MoE dp4a untuk OpenCL.

  • Perubahan ini dilacak sebagai pull request #29439 di repositori ggml-org/llama.cpp.
  • Ini memperkenalkan dukungan untuk format kuantisasi tertentu (A8 Q8_0) menggunakan set instruksi dp4a di dalam backend OpenCL.