llama.cpp 项目发布了 b10870 版本,引入了针对 Intel coopmat1 硬件的 Vulkan 支持,用于 f16 B 类型矩阵乘法管道和 warp 瓦片大小调整。
- 为 Intel coopmat1 添加了 f16 B 类型矩阵乘法管道和 warp 瓦片大小调整。
- 在所有供应商中启用了密集矩阵乘法的 f16 B 类型管道,同时保持 Mixture of Experts (MoE) 支持仅限 Intel。
- 添加了缺失的 OCP FP4 分支,并将 required_subgroup_size 限制为 Intel。
- 简化和优化了 mul_mat_id 中的 mmp 选择逻辑。
此更新扩展了特定矩阵操作的 Vulkan 兼容性,并优化了内部选择逻辑以提高硬件利用率。