Proyek llama.cpp merilis build b10262, yang memperkenalkan dukungan untuk operasi GATED_LINEAR_ATTN di backend Vulkan-nya. Pembaruan ini juga mencakup pembaruan dokumentasi untuk operasi Vulkan dan menghapus konstanta spesifikasi GLA yang tidak digunakan.

  • Mengimplementasikan operasi GATED_LINEAR_ATTN untuk Vulkan (#25601)
  • Memperbarui dokumentasi operasi Vulkan
  • Menghapus konstanta spesifikasi GLA yang tidak digunakan

Rilis ini menyediakan biner untuk macOS, Linux, Windows, Android, dan iOS di berbagai backend CPU, CUDA, ROCm, OpenVINO, SYCL, dan Vulkan.