Proyek llama.cpp merilis versi b10254, memperkenalkan template obrolan baru untuk model DeepSeek V4 Flash 0731 bersama dengan pembaruan pada template DeepSeek V4 yang ada.

  • Menyelaraskan template DeepSeek V4 dengan pengkode resmi sambil mengecualikan perubahan perilaku parser.
  • Secara default, membuang riwayat pemikiran untuk DeepSeek V4 kecuali preserve_reasoning diminta atau alat hadir.
  • Menambahkan instruksi format respons output terstruktur dan meneruskan skema ke perenderan template.
  • Memperkenalkan template Flash 0731 terpisah untuk menangani pemetaan upaya penalaran tinggi dan maksimal yang diperbarui.
  • Termasuk perbaikan untuk konsumsi pemisah panggilan alat parser DSML dan pemilihan template deepseek v4 0731.

Pembaruan ini memastikan kompatibilitas dengan spesifikasi model DeepSeek terbaru dan meningkatkan penanganan output terstruktur.