llama.cpp 项目发布了构建版本 b10639,其中包含对 Vulkan 后端的修复,此前 warptiles 假设 warp 大小小于或等于 64。此更改将 warp 大小限制为绕过较大 warp 的问题。

该版本提供了适用于 macOS(Apple Silicon 和 Intel)、iOS、Linux(CPU、Vulkan、ROCm、OpenVINO、SYCL)、Android、Windows(CPU、CUDA、Vulkan、OpenCL、OpenVINO、SYCL、ROCm)和 openEuler 的二进制文件。它还包含了 llama.cpp UI。

此更新确保了与使用大于 64 的 warp 大小的硬件配置的兼容性。