llama.cpp プロジェクトは、b10867 リリースで統合 GPU (iGPU) に対するデフォルトの遅延テンソル読み込みを無効にしました。この変更は、以前の「AUTO」遅延モード設定で導入された回帰に対処するものです。
- このアップデートは、AUTO 構成内での iGPU における遅延読み込みの無効化を除き、変更を元に戻します。
- 特定の遅延モード自動修正を追加することで、iGPU の回帰を修正します。
- macOS、Linux、Windows、Android、openEuler 用のビルド済みバイナリが、CPU、CUDA、Vulkan、ROCm、その他のバックエンドで利用可能です。