Proyek llama.cpp telah merilis build b10603, yang memperkenalkan dukungan Prediksi Multi-Token (MTP) untuk model GLM-4.5-Air.

  • Menambahkan kemampuan MTP untuk GLM-4.5-Air melalui pull request #26534.
  • Menyediakan biner untuk macOS (Apple Silicon dan Intel), iOS, Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows (CPU, CUDA 12/13, Vulkan, OpenCL, OpenVINO, SYCL, ROCm), dan openEuler.

Rilis ini memungkinkan pengguna menjalankan GLM-4.5-Air dengan MTP di berbagai arsitektur perangkat keras.