DeepSeek telah secara resmi merilis model DeepSeek-V4.1-Flash, yang merupakan anggota terkecil dari keluarga arsitektur barunya dan memiliki pemahaman visual multimodal asli. Arsitektur baru ini dirancang untuk memberikan batas kemampuan yang lebih tinggi, kecepatan inferensi yang lebih cepat, throughput yang lebih tinggi, dan potensi skalabilitas yang lebih baik untuk model yang lebih besar.

  • Model ini mencapai skor 90.9 di GPQA Diamond, 36.8 di HLE, dan 3471 di Codeforces.
  • Model ini sekarang tersedia di API DeepSeek dengan nama "deepseek-flash", menggantikan varian V4 Flash yang pensiun.
  • Permintaan ke model deepseek-v4-pro yang pensiun akan dialihkan ke V4.1 Flash mulai 14 September 2026, pada titik harga baru yang lebih rendah.
  • Harga API telah disesuaikan turun untuk mencerminkan peluncuran model baru ini.

DeepSeek menyatakan bahwa pengujian ekstensif menunjukkan V4.1 Flash mengungguli DeepSeek V4 Pro sebelumnya dalam hal kinerja, biaya, kecepatan, dan waktu total.