llama.cpp プロジェクトはビルド b10603 をリリースし、GLM-4.5-Air モデルのマルチトークン予測(MTP)サポートを導入しました。
- pull request #26534 経由で GLM-4.5-Air の MTP 機能を追加。
- macOS (Apple Silicon および Intel)、iOS、Linux (CPU、Vulkan、ROCm、OpenVINO、SYCL)、Android、Windows (CPU、CUDA 12/13、Vulkan、OpenCL、OpenVINO、SYCL、ROCm)、openEuler 用のバイナリを提供。
このリリースにより、ユーザーは幅広いハードウェアアーキテクチャで MTP を使用して GLM-4.5-Air を実行できるようになります。