llama.cpp プロジェクトはビルド b11158 をリリースし、Vulkan バックエンド経由で Adreno GPU 用に特別に調整された KHR cooperative matrix サポートを含んでいます。

  • 互換性のあるハードウェアでのパフォーマンス向上のため、Vulkan バックエンドの cooperative matrix (coopmat) サポートを有効化しました。
  • 実装内の mul_mat_s 関数を修正しました。
  • コードベースからデバッグ文を削除しました。

このアップデートにより、Linux および Android を実行する Snapdragon デバイスと、Adreno グラフィックスを搭載した Windows arm64 システムの最適化された GPU アクセラレーションが提供されます。