llama.cpp 项目发布了构建版本 b11067,其中为 WebGPU 后端引入了融合的 GDN + 复制操作。
- 该版本包含适用于 macOS(Apple Silicon 和 Intel)、Linux(Ubuntu 带 CPU、Vulkan、CUDA 12/13、ROCm 10.0、OpenVINO、SYCL)、Windows(CPU、OpenCL Adreno、CUDA 12/13、Vulkan、OpenVINO、SYCL、ROCm 10.0)、Android 和 iOS 的二进制文件。
- 此构建中禁用了 macOS Apple Silicon 的 KleidiAI 支持。
- openEuler 支持也已禁用。
此次更新为用户提供了跨多个平台和加速器的更新二进制文件,以及特定的 WebGPU 优化。