llama.cpp 项目发布了构建版本 b11158,其中包含通过 Vulkan 后端针对 Adreno GPU 特别调整的 KHR 协作矩阵支持。

  • 为 Vulkan 后端启用了协作矩阵 (coopmat) 支持,以在兼容硬件上提升性能。
  • 修复了实现中的 mul_mat_s 函数。
  • 从代码库中移除了调试语句。

此更新为运行 Linux 和 Android 的 Snapdragon 设备以及具有 Adreno 图形的 Windows arm64 系统提供了优化的 GPU 加速。