El proyecto llama.cpp ha añadido un kernel binario A8 Q8_0 non-MoE dp4a para OpenCL.
- El cambio está registrado como pull request #29439 en el repositorio ggml-org/llama.cpp.
- Introduce soporte para un formato de cuantización específico (A8 Q8_0) utilizando el conjunto de instrucciones dp4a dentro del backend de OpenCL.