Proyek llama.cpp merilis build b11017, yang mencakup optimasi Vulkan untuk melewati pekerjaan Mixture of Experts (MoE) yang tidak perlu di jalur mul_mm coopmat1.

Pembaruan ini menyediakan binaris pra-bangun untuk macOS (Apple Silicon dan Intel), Linux (CPU, Vulkan, CUDA 12/13, ROCm, OpenVINO, SYCL), Windows (CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm), Android, dan openEuler.

Rilis ini juga mencakup antarmuka pengguna llama.cpp.