Proyek llama.cpp telah menambahkan kernel biner A8 Q8_0 non-MoE dp4a untuk OpenCL.
- Perubahan ini dilacak sebagai pull request #29439 di repositori ggml-org/llama.cpp.
- Ini memperkenalkan dukungan untuk format kuantisasi tertentu (A8 Q8_0) menggunakan set instruksi dp4a di dalam backend OpenCL.