O lançamento llama.cpp b10677 corrige um bug crítico no backend Vulkan onde a ausência de dependências view-alias fazia o otimizador de grafos reordenar os nós incorretamente.
- A correção garante que `is_src_of` trate corretamente duas visualizações de um tensor como dependentes, impedindo erros silenciosos durante a decodificação gulosa e a decodificação especulativa.
- Nós com operações como NONE, RESHAPE, TRANSPOSE, VIEW ou PERMUTE não são mais tratados como dependências de alias, restaurando a liberdade do otimizador sem comprometer a correção.
- O código compila tornando o parâmetro lambda const e capturando `is_empty` em `is_src_of`, resolvendo problemas de visibilidade com ponteiros não-const.
- Esta alteração corrige especificamente problemas de estado recorrente para modelos como Qwen3.8 no hardware Vulkan da AMD e NVIDIA, enquanto o CUDA permanece inalterado.
O lançamento resolve a issue #27805 e fornece binários para macOS, Linux, Windows, Android e openEuler em CPU, GPU e vários backends de acelerador.