llama.cpp परियोजना ने बिल्ड b11017 जारी किया, जिसमें mul_mm coopmat1 पथ में Mixture of Experts (MoE) के अनावश्यक कार्य को छोड़ने के लिए Vulkan अनुकूलन शामिल है।

इस अपडेट में macOS (Apple Silicon और Intel), Linux (CPU, Vulkan, CUDA 12/13, ROCm, OpenVINO, SYCL), Windows (CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm), Android, और openEuler के लिए पूर्व-निर्मित बाइनरी शामिल हैं।

रिलीज़ में llama.cpp UI भी शामिल है।