llama.cpp 项目在 b10867 版本中默认禁用了集成 GPU (iGPU) 的惰性张量加载。此更改解决了先前 "AUTO" 惰性模式设置中引入的回归问题。

  • 该更新撤销了除在 AUTO 配置中禁用 iGPU 惰性加载之外的所有更改。
  • 通过添加特定的惰性模式自动修复,修复了 iGPU 回归问题。
  • 预构建的二进制文件适用于 macOS、Linux、Windows、Android 和 openEuler,支持 CPU、CUDA、Vulkan、ROCm 及其他后端。