El proyecto llama.cpp lanzó la compilación b10262, que introduce soporte para la operación GATED_LINEAR_ATTN en su backend de Vulkan. Esta actualización también incluye actualizaciones de documentación para operaciones de Vulkan y elimina una constante de especificación GLA no utilizada.

  • Implementada la operación GATED_LINEAR_ATTN para Vulkan (#25601)
  • Actualizada la documentación de las operaciones de Vulkan
  • Eliminada la constante de especificación GLA no utilizada

Esta versión proporciona binarios para macOS, Linux, Windows, Android e iOS a través de los backends CPU, CUDA, ROCm, OpenVINO, SYCL y Vulkan.