llama.cpp プロジェクトはビルド b11025 をリリースしました。これには、Nemotron 複数トークン予測 (MTP) サポートの拡張が含まれています。

  • このアップデートでは、この機能に対する最初の修正が行われ、不要な宣言が削除されました。
  • macOS (Apple Silicon および Intel)、iOS、Linux (CPU、Vulkan、CUDA 12/13、ROCm、OpenVINO、SYCL)、Android、Windows (CPU、OpenCL、CUDA 12/13、Vulkan、OpenVINO、SYCL、ROCm)、openEuler 用のバイナリが提供されています。
  • スタンドアロン UI ビルドもダウンロード可能です。