llama.cpp 项目发布了构建版本 b11017,其中包含一项 Vulkan 优化,用于在 mul_mm coopmat1 路径中跳过不必要的 Mixture of Experts (MoE) 工作。

此更新为 macOS(Apple Silicon 和 Intel)、Linux(CPU、Vulkan、CUDA 12/13、ROCm、OpenVINO、SYCL)、Windows(CPU、OpenCL Adreno、CUDA 12/13、Vulkan、OpenVINO、SYCL、ROCm)、Android 和 openEuler 提供了预构建的二进制文件。

该版本还包含了 llama.cpp 的用户界面。