llama.cpp 项目发布了构建版本 b11158,其中包含通过 Vulkan 后端针对 Adreno GPU 特别调整的 KHR 协作矩阵支持。
- 为 Vulkan 后端启用了协作矩阵 (coopmat) 支持,以在兼容硬件上提升性能。
- 修复了实现中的 mul_mat_s 函数。
- 从代码库中移除了调试语句。
此更新为运行 Linux 和 Android 的 Snapdragon 设备以及具有 Adreno 图形的 Windows arm64 系统提供了优化的 GPU 加速。
llama.cpp 项目发布了构建版本 b11158,其中包含通过 Vulkan 后端针对 Adreno GPU 特别调整的 KHR 协作矩阵支持。
此更新为运行 Linux 和 Android 的 Snapdragon 设备以及具有 Adreno 图形的 Windows arm64 系统提供了优化的 GPU 加速。