El proyecto llama.cpp lanzó la versión b10657, introduciendo nuevos núcleos binarios de OpenCL para modelos de expertos mixtos. Específicamente, la actualización añade `kernel_gemm_moe_q4_0_q8_1_dp4a_bin` y `kernel_gemm_moe_mxfp4_q8_1_dp4a_bin` para soportar cómputo eficiente en hardware compatible.
- Añadidos núcleos binarios de OpenCL para GEMO MOE con cuantizaciones q4_0/q8_1 y mxfp4/q8_1.
- Proporcionados binarios para macOS (Apple Silicon e Intel), iOS, Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Windows (CPU, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm), Android y openEuler.
- El soporte de KleidiAI en Apple Silicon de macOS permanece deshabilitado en esta versión.
Esta actualización expande la compatibilidad de hardware para modelos de expertos mixtos habilitando implementaciones específicas de núcleos OpenCL.