O projeto llama.cpp lançou a compilação b10262, que introduz suporte para a operação GATED_LINEAR_ATTN em seu backend Vulkan. Esta atualização também inclui atualizações de documentação para operações Vulkan e remove uma constante de especificação GLA não utilizada.

  • Implementada a operação GATED_LINEAR_ATTN para Vulkan (#25601)
  • Atualizada a documentação das operações Vulkan
  • Removida a constante de especificação GLA não utilizada

Esta versão fornece binários para macOS, Linux, Windows, Android e iOS através dos backends CPU, CUDA, ROCm, OpenVINO, SYCL e Vulkan.