llama.cppプロジェクトはビルドb10344をリリースし、NemotronおよびNemotron Nanoモデル用にMulti-Token Prediction (MTP)サポートを導入しました。
- Nemotron NanoモデルのMTPサポートを追加。
- Nemotronモデル用のmtp_flags構成を導入。
- macOS(Apple SiliconおよびIntel)、iOS、Linux(CPU、Vulkan、ROCm、OpenVINO、SYCL)、Android、Windows(CPU、CUDA 12/13、Vulkan、OpenCL、OpenVINO、SYCL、HIP)、openEuler向けのバイナリを提供。
このアップデートにより、ユーザーは幅広いハードウェアプラットフォームとオペレーティングシステムでNemotronモデルのMTP機能を活用できるようになります。