أصدر مشروع llama.cpp الإصدار b11017، الذي يتضمن تحسينًا لـ Vulkan لتخطي عمل Mixture of Experts (MoE) غير الضروري في مسار mul_mm coopmat1.
يوفر هذا التحديث ثنائيات جاهزة لأنظمة macOS (Apple Silicon و Intel)، و Linux (CPU، Vulkan، CUDA 12/13، ROCm، OpenVINO، SYCL)، و Windows (CPU، OpenCL Adreno، CUDA 12/13، Vulkan، OpenVINO، SYCL، ROCm)، و Android، و openEuler.
يتضمن الإصدار أيضًا واجهة المستخدم الخاصة بـ llama.cpp.