Выпуск llama.cpp b10677 устраняет критическую ошибку во внутреннем механизме Vulkan, из-за которой отсутствие зависимостей alias-представлений приводило к некорректной перестановке узлов оптимизатором графа.
- Исправление гарантирует, что `is_src_of` правильно рассматривает два представления одного тензора как зависимые, предотвращая скрытые ошибки при жадном декодировании и спекулятивном декодировании.
- Узлы с операциями NONE, RESHAPE, TRANSPOSE, VIEW или PERMUTE больше не рассматриваются как зависимости алиасинга, что восстанавливает свободу оптимизатора без ущерба для корректности.
- Код компилируется благодаря приведению параметра lambda к const и захвату `is_empty` в `is_src_of`, что устраняет проблемы видимости с неконстантными указателями.
- Это изменение конкретно исправляет проблемы с рекуррентным состоянием для моделей вроде Qwen3.8 на оборудовании AMD и NVIDIA Vulkan, тогда как CUDA остаётся без изменений.
Выпуск решает проблему #27805 и предоставляет бинарные файлы для macOS, Linux, Windows, Android и openEuler для CPU, GPU и различных ускорителей.