DeepSeek telah mempublikasikan model resmi DeepSeek-V4-Flash-0731 di Hugging Face dan menggeser API-nya ke beta publik mulai 31 Juli 2026. Rilis ini menggantikan versi pratinjau sebelumnya melalui re-post-training alih-alih perubahan arsitektur, memberikan peningkatan signifikan dalam benchmark agentic dan coding sambil mempertahankan ukuran parameter 284B yang sama.

  • Model ini memiliki arsitektur MoE dengan 284B parameter dengan 13B diaktifkan per token dan menyertakan modul DSpark speculative decoding.
  • Model ini mencapai skor lebih tinggi daripada V4-Pro (Preview) pada semua benchmark agentic yang dipublikasikan, termasuk 82.7 pada Terminal Bench 2.1 dan 54.2 pada NL2Repo.
  • Harga API ditetapkan sebesar $0.14 per 1M token input dan $0.28 per 1M token output, sekitar sepertiga dari biaya V4-Pro.
  • Bobotnya berlisensi MIT dan ungated, memungkinkan self-hosting di sekitar 110 GB memori dengan kuantisasi atau node 4×GB300 untuk presisi penuh.

Pembaruan ini menyediakan opsi yang hemat biaya untuk loop agen dan tugas coding, menawarkan kinerja yang bersaing dengan model yang lebih mahal sambil tetap dapat diakses oleh pengembang indie dan perusahaan melalui API atau self-hosting.