llama.cpp プロジェクトはビルド b10603 をリリースし、GLM-4.5-Air モデルのマルチトークン予測(MTP)サポートを導入しました。

  • pull request #26534 経由で GLM-4.5-Air の MTP 機能を追加。
  • macOS (Apple Silicon および Intel)、iOS、Linux (CPU、Vulkan、ROCm、OpenVINO、SYCL)、Android、Windows (CPU、CUDA 12/13、Vulkan、OpenCL、OpenVINO、SYCL、ROCm)、openEuler 用のバイナリを提供。

このリリースにより、ユーザーは幅広いハードウェアアーキテクチャで MTP を使用して GLM-4.5-Air を実行できるようになります。