llama.cpp プロジェクトはビルド b11017 をリリースしました。これには、mul_mm coopmat1 パスで不要な Mixture of Experts (MoE) の作業をスキップするための Vulkan 最適化が含まれています。
このアップデートでは、macOS (Apple Silicon および Intel)、Linux (CPU、Vulkan、CUDA 12/13、ROCm、OpenVINO、SYCL)、Windows (CPU、OpenCL Adreno、CUDA 12/13、Vulkan、OpenVINO、SYCL、ROCm)、Android、および openEuler 用のプリビルドバイナリが提供されます。
リリースには llama.cpp UI も含まれています。