llama.cpp プロジェクトはビルド b11158 をリリースし、Vulkan バックエンド経由で Adreno GPU 用に特別に調整された KHR cooperative matrix サポートを含んでいます。
- 互換性のあるハードウェアでのパフォーマンス向上のため、Vulkan バックエンドの cooperative matrix (coopmat) サポートを有効化しました。
- 実装内の mul_mat_s 関数を修正しました。
- コードベースからデバッグ文を削除しました。
このアップデートにより、Linux および Android を実行する Snapdragon デバイスと、Adreno グラフィックスを搭載した Windows arm64 システムの最適化された GPU アクセラレーションが提供されます。