El proyecto llama.cpp lanzó la compilación b11017, que incluye una optimización de Vulkan para omitir el trabajo innecesario de Mixture of Experts (MoE) en la ruta mul_mm coopmat1.

Esta actualización proporciona binarios precompilados para macOS (Apple Silicon e Intel), Linux (CPU, Vulkan, CUDA 12/13, ROCm, OpenVINO, SYCL), Windows (CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm), Android y openEuler.

El lanzamiento también incluye la interfaz de usuario de llama.cpp.