llama.cpp プロジェクトはビルド b11025 をリリースしました。これには、Nemotron 複数トークン予測 (MTP) サポートの拡張が含まれています。
- このアップデートでは、この機能に対する最初の修正が行われ、不要な宣言が削除されました。
- macOS (Apple Silicon および Intel)、iOS、Linux (CPU、Vulkan、CUDA 12/13、ROCm、OpenVINO、SYCL)、Android、Windows (CPU、OpenCL、CUDA 12/13、Vulkan、OpenVINO、SYCL、ROCm)、openEuler 用のバイナリが提供されています。
- スタンドアロン UI ビルドもダウンロード可能です。