Proyek llama.cpp telah merilis build b11025, yang mencakup ekstensi dukungan Prediksi Multi-Token (MTP) Nemotron.
- Pembaruan ini menangani perbaikan pertama untuk fitur ini dan menghapus deklarasi yang tidak perlu.
- Binari disediakan untuk macOS (Apple Silicon dan Intel), iOS, Linux (CPU, Vulkan, CUDA 12/13, ROCm, OpenVINO, SYCL), Android, Windows (CPU, OpenCL, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm), dan openEuler.
- Build UI mandiri juga tersedia untuk diunduh.