DeepSeek telah merilis DeepSeek-V4-Flash-0731, versi pembaruan dari model "Flash" berukuran lebih kecil yang mengungguli DeepSeek-V4-Pro yang lebih besar pada benchmark independen. Rilis ini memanfaatkan proses fine-tuning baru sambil mempertahankan arsitektur Mixture-of-Experts asli dengan total 284 miliar parameter.

  • Model ini mencapai skor 50 poin pada Indeks Kecerdasan Artificial Analysis, sejalan dengan Gemini 3.6 Flash dan hanya tertinggal di belakang GPT-5.6 Luna dan GLM-5.2.
  • Biaya yang dibutuhkan adalah $0,03 per tugas pada benchmark dibandingkan dengan $0,05 untuk GPT-5.6 Luna, menempatkannya di Pareto frontier untuk kecerdasan versus biaya.
  • Kemampuan agentic meningkat secara signifikan, mencetak skor Elo 1.558 pada GDPval-AA dan memecahkan 82,7% masalah pada Terminal-Bench 2.1.
  • Bobot tersedia di bawah lisensi MIT, dengan harga API ditetapkan sebesar $0,14 per juta token input.

Pembaruan ini menunjukkan bahwa model yang sangat cerdas dapat diimplementasikan secara ekonomis untuk tugas-tugas yang selalu aktif seperti layanan pelanggan dan triase bug tanpa memerlukan akses ke model proprietaris.