llama.cpp 项目发布了构建版本 b10721,其中包括对 WebGPU 后端的重大修复,并扩展了 Windows 上的硬件支持。

  • 修复了当偏移量不是 4 的倍数时 WebGPU `ggml_backend_tensor_get()` 实现中的崩溃问题。
  • 增加了对带有 CUDA 13.4 的 Windows arm64 的预览支持。
  • 提供了适用于 macOS (Apple Silicon 和 Intel)、Linux (CPU、Vulkan、ROCm、OpenVINO、SYCL)、Android 以及 Windows 上各种 CPU 和 GPU 后端的二进制文件。

此版本确保了 WebGPU 用户在非对齐内存偏移下的稳定性,并扩展了对 Windows 上新 CUDA 架构的兼容性。