llama.cpp プロジェクトはバージョン b10870 をリリースし、Intel coopmat1 ハードウェア用に f16 B型行列乗算パイプラインとワープタイルサイズ調整の Vulkan サポートを導入しました。

  • Intel coopmat1 向けに f16 B型行列乗算パイプラインとワープタイルサイズ調整を追加。
  • すべてのベンダーで密集行列乗算の f16 B型パイプラインを有効化し、Mixture of Experts (MoE) サポートは Intel のみに維持。
  • 欠落していた OCP FP4 ブランチを追加し、required_subgroup_size を Intel に制限。
  • mul_mat_id 内の mmp 選択を簡素化および精緻化。

このアップデートにより、特定の行列演算に対する Vulkan 互換性が拡張され、ハードウェア利用率の向上のために内部選択ロジックが精緻化されました。