llama.cppプロジェクトはビルドb10262をリリースし、VulkanバックエンドでGATED_LINEAR_ATTN演算のサポートを導入しました。このアップデートにはVulkan演算のドキュメント更新も含まれ、未使用のGLA仕様定数が削除されました。

  • Vulkan用のGATED_LINEAR_ATTN演算を実装 (#25601)
  • Vulkan演算のドキュメントを更新
  • 未使用のGLA仕様定数を削除

このリリースでは、CPU、CUDA、ROCm、OpenVINO、SYCL、およびVulkanバックエンド向けに、macOS、Linux、Windows、Android、iOS用のバイナリが提供されています。