Hardware & chips
github llama.cpp · 16 天前 · 44 次浏览

llama.cpp b10839 修复 Vulkan GET_ROWS 未对齐偏移导致的崩溃

llama.cpp 项目发布了版本 b10839,解决了因张量行检索操作中的未对齐偏移而在 Vulkan 后端引发的严重崩溃问题。此前,在使用带有非零视图偏移的 `ggml_view` 时,Qwen3-TTS 和 Qwen3-VL 等模型会失败,因为着色器会对相对于 `minStorageBufferOffsetAlignment` 的对齐违规进行断言。此次更新在量化和非量化路径中实现了对齐偏移的原生支持,从而消除了对 CPU 回退的需求。