llama.cppプロジェクトはビルドb10262をリリースし、VulkanバックエンドでGATED_LINEAR_ATTN演算のサポートを導入しました。このアップデートにはVulkan演算のドキュメント更新も含まれ、未使用のGLA仕様定数が削除されました。
- Vulkan用のGATED_LINEAR_ATTN演算を実装 (#25601)
- Vulkan演算のドキュメントを更新
- 未使用のGLA仕様定数を削除
このリリースでは、CPU、CUDA、ROCm、OpenVINO、SYCL、およびVulkanバックエンド向けに、macOS、Linux、Windows、Android、iOS用のバイナリが提供されています。