Proyek llama.cpp telah merilis build b10093, yang mencakup pembaruan spesifik untuk mendukung model DeepSeek v4. Rilis ini menangani penanganan template dan memperkenalkan flag konfigurasi baru untuk keluarga model ini.

  • Memperbaiki template buatan DeepSeek v4 agar secara eksplisit mengikuti perilaku referensi.
  • Menambahkan dukungan untuk flag `drop_reasoning` DeepSeek v4.
  • Mengaitkan parser DeepSeek 3.2 juga untuk menangani input DeepSeek v4.
  • Termasuk perbaikan untuk pengurian ulang hasil alat.

Pembaruan ini memastikan format chat yang benar dan penanganan token penalaran untuk model DeepSeek v4 dalam llama.cpp.