github
llama.cpp
·
16 д назад
·
44 просмотра
llama.cpp b10839 исправляет сбои из-за несовпадения смещений GET_ROWS в Vulkan
Проект llama.cpp выпустил версию b10839, устраняющую критические сбои в бэкенде Vulkan, вызванные несовпадением смещений при операциях извлечения строк тензора. Ранее модели Qwen3-TTS и Qwen3-VL давали сбой при использовании `ggml_view` со смещениями вида, отличными от нуля, поскольку шейдер выдавал ошибку при нарушении выравнивания относительно `minStorageBufferOffsetAlignment`. Данное обновление реализует нативную поддержку выровненных смещений как в квантованных, так и в неквантованных путях, устраняя необходимость возврата к CPU.