Proyek llama.cpp merilis versi b10254, memperkenalkan template obrolan baru untuk model DeepSeek V4 Flash 0731 bersama dengan pembaruan pada template DeepSeek V4 yang ada.
- Menyelaraskan template DeepSeek V4 dengan pengkode resmi sambil mengecualikan perubahan perilaku parser.
- Secara default, membuang riwayat pemikiran untuk DeepSeek V4 kecuali preserve_reasoning diminta atau alat hadir.
- Menambahkan instruksi format respons output terstruktur dan meneruskan skema ke perenderan template.
- Memperkenalkan template Flash 0731 terpisah untuk menangani pemetaan upaya penalaran tinggi dan maksimal yang diperbarui.
- Termasuk perbaikan untuk konsumsi pemisah panggilan alat parser DSML dan pemilihan template deepseek v4 0731.
Pembaruan ini memastikan kompatibilitas dengan spesifikasi model DeepSeek terbaru dan meningkatkan penanganan output terstruktur.