llama.cpp 项目发布了构建版本 b10587,在 Vulkan 后端引入了 GGML_OP_PAD_REFLECT_1D 操作。此更新实现了必要的 GLSL 计算着色器,并在 ggml-vulkan 模块中注册了 SPIR-V 编译。

  • 在 pad_reflect_1d.comp 中实现了 PAD_REFLECT_1D 逻辑,并更新了 vulkan-shaders-gen.cpp 以进行注册。
  • 更新 ggml-vulkan.cpp 以处理新操作的常量、流水线创建、分发函数和调试验证。
  • 在配备 Vulkan 1.4 和 Mesa 25.2.8 的 Intel Iris Xe 上验证了正确性,通过了所有测试用例。
  • 提供了性能基准测试,显示在不同张量形状下的执行时间范围为 5.38 us/run 到 158.31 us/run。

此版本支持在 Vulkan 加速推理任务中使用反射填充,并为 macOS、Linux、Windows、Android 和 openEuler 平台提供二进制文件。