llama.cpp 项目发布了构建版本 b10150,其中包括对将操作卸载到权重后端的 ggml 逻辑的调整。此更新还解决了 llama dsv4 图的修复问题。

  • ggml:调整将操作卸载到权重后端的逻辑
  • llama:dsv4 图修复

此版本为 macOS、Linux、Windows、Android 和 iOS 提供了更新的二进制文件,支持包括 CPU、CUDA、Vulkan、ROCm 和 OpenVINO 在内的各种硬件后端。