Proyek llama.cpp merilis build b10262, yang memperkenalkan dukungan untuk operasi GATED_LINEAR_ATTN di backend Vulkan-nya. Pembaruan ini juga mencakup pembaruan dokumentasi untuk operasi Vulkan dan menghapus konstanta spesifikasi GLA yang tidak digunakan.
- Mengimplementasikan operasi GATED_LINEAR_ATTN untuk Vulkan (#25601)
- Memperbarui dokumentasi operasi Vulkan
- Menghapus konstanta spesifikasi GLA yang tidak digunakan
Rilis ini menyediakan biner untuk macOS, Linux, Windows, Android, dan iOS di berbagai backend CPU, CUDA, ROCm, OpenVINO, SYCL, dan Vulkan.