Proyek llama.cpp merilis build b10237, yang memperkenalkan dukungan Prediksi Multi-Token (MTP) untuk model DeepSeek V3.2.
- Pembaruan ini mengaktifkan kemampuan MTP secara khusus untuk DeepSeek V3.2 dalam kerangka kerja llama.
- Logika penemuan tipe model disesuaikan sehingga lapisan MTP tidak perlu disertakan secara eksplisit selama proses deteksi.
- Binari disediakan untuk macOS (Apple Silicon dan Intel), iOS, Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows (CPU, CUDA 12/13, Vulkan, OpenCL, OpenVINO, SYCL, HIP), dan openEuler.
Rilis ini memungkinkan pengguna memanfaatkan MTP dengan DeepSeek V3.2 pada berbagai arsitektur perangkat keras dan sistem operasi.