llama.cpp 项目发布了版本 b11012,通过拉取请求 #28988 引入了对 qwen4exp hc 操作的 Vulkan 支持。此更新还包括对过时注释的修复。

该版本在多个平台和硬件加速器上提供二进制文件和框架:

  • macOS:Apple Silicon (arm64)、Intel (x64) 和 iOS XCFramework。
  • Linux:针对 CPU、Vulkan、CUDA 12/13、ROCm 10.0、OpenVINO 和 SYCL 的 Ubuntu 构建。
  • Windows:针对 CPU、OpenCL Adreno、CUDA 12/13、Vulkan、OpenVINO、SYCL 和 ROCm 10.0 的构建。
  • Android:arm64 CPU 支持。

此版本使用户能够在受支持的操作系统上,在兼容 Vulkan 的 GPU 上运行具有高计算操作的 qwen4exp 模型。