O projeto llama.cpp lançou a compilação b10262, que introduz suporte para a operação GATED_LINEAR_ATTN em seu backend Vulkan. Esta atualização também inclui atualizações de documentação para operações Vulkan e remove uma constante de especificação GLA não utilizada.
- Implementada a operação GATED_LINEAR_ATTN para Vulkan (#25601)
- Atualizada a documentação das operações Vulkan
- Removida a constante de especificação GLA não utilizada
Esta versão fornece binários para macOS, Linux, Windows, Android e iOS através dos backends CPU, CUDA, ROCm, OpenVINO, SYCL e Vulkan.