llama.cppプロジェクトはバージョンb10442をリリースし、行列乗算ルーチンのメモリ安全性の問題に対処しながら、Intel Xeハードウェア用の特定のVulkan最適化を導入しました。
- Intel Xeのcoopmat mul_mm用にSHMEM_STRIDE_PADおよびAPPLY_SLM_A_RESHAPEフラグを追加。
- matmul_shmem_support内のIntel SHMEM_STRIDE_PAD=0の共有メモリ推定を修正。
- データ処理を改善するため、共有kvalues_mxfp4のキャッシュラインアライメントを実装。
- キャッシュラインパディング変更後、kvalues_mxfp4初期化における境界外読み取り(OOB)を解決。
- SLM-Aリシェイプ調整をIntel Windowsドライバーに制限し、必要な場合はmxfp4キャッシュラインパディングを元に戻す。
このリリースでは、CPU、Vulkan、CUDA、ROCm、OpenVINO、およびSYCLバックエンド向けに、macOS、Linux、Windows、Android、openEuler用の更新されたバイナリが提供されます。