llama.cpp プロジェクトはビルド b11026 をリリースし、TENSOR_SKIP フラグが設定されている場合に gate_up_exps をスキップする変更を導入しました。この修正は、MTP テンソルが融合されているが読み込まれていない Qwen35MoE モデルに特に必要です。
今回のリリースでは、macOS(Apple Silicon および Intel)、iOS、Linux(CPU、Vulkan、CUDA 12/13、ROCm 10.0、OpenVINO、SYCL)、Android、Windows(CPU、OpenCL、CUDA 12/13、Vulkan、OpenVINO、SYCL、ROCm 10.0)、openEuler 用のバイナリとフレームワークが提供されています。
このアップデートは、融合されているが読み込まれていない MTP テンソルを正しく処理することで、特定の Qwen35MoE 構成との互換性を確保します。