llama.cpp b11013 版本通过修正 im2col 和 im2col_3d 着色器中的 buffer_reference 对齐方式,解决了 Vulkan 中的验证错误。该修复通过将指针步长与实际写入大小对齐,解决了 issue #28960,消除了 GPU-AV 的验证命中。

  • 修复了由 im2col.comp 和 im2col_3d.comp 中未对齐写入触发的 VUID-RuntimeSpirv-PhysicalStorageBuffer64-06315。
  • 设置 buffer_reference_align = D_SIZE 以匹配 float (4) 和 float16_t (2) 的每个变体定义。
  • 将 IM2COL 和 IM2COL_3D 操作的验证命中次数从 20 次减少到 0 次。

此更改确保在支持的平台上 GPU 加速推理时的 Vulkan 验证行为正确。