llama.cppプロジェクトはバージョンb10442をリリースし、行列乗算ルーチンのメモリ安全性の問題に対処しながら、Intel Xeハードウェア用の特定のVulkan最適化を導入しました。

  • Intel Xeのcoopmat mul_mm用にSHMEM_STRIDE_PADおよびAPPLY_SLM_A_RESHAPEフラグを追加。
  • matmul_shmem_support内のIntel SHMEM_STRIDE_PAD=0の共有メモリ推定を修正。
  • データ処理を改善するため、共有kvalues_mxfp4のキャッシュラインアライメントを実装。
  • キャッシュラインパディング変更後、kvalues_mxfp4初期化における境界外読み取り(OOB)を解決。
  • SLM-Aリシェイプ調整をIntel Windowsドライバーに制限し、必要な場合はmxfp4キャッシュラインパディングを元に戻す。

このリリースでは、CPU、Vulkan、CUDA、ROCm、OpenVINO、およびSYCLバックエンド向けに、macOS、Linux、Windows、Android、openEuler用の更新されたバイナリが提供されます。