DeepSeek telah merilis DeepSeek-V3-0324, sebuah pembaruan model yang menunjukkan peningkatan signifikan dibandingkan pendahulunya, DeepSeek-V3, khususnya dalam kemampuan penalaran, eksekusi kode, dan kemahiran penulisan bahasa Mandarin.

  • Skor MMLU-Pro meningkat dari 75,9 menjadi 81,2, GPQA dari 59,1 menjadi 68,4, AIME dari 39,6 menjadi 59,4, dan LiveCodeBench dari 39,2 menjadi 49,2.
  • Peningkatan output pengembangan web front-end dengan eksekusi kode dan estetika yang lebih baik.
  • Gaya penulisan bahasa Mandarin dioptimalkan agar selaras dengan R1 serta peningkatan kualitas konten berbentuk panjang hingga menengah.
  • Memperbaiki masalah akurasi pemanggilan fungsi yang ada pada versi V3 sebelumnya dan meningkatkan kemampuan penulisan ulang interaktif multi-giliran.

Pembaruan ini memberikan kinerja benchmark yang lebih baik dan pemanggilan fungsi yang lebih andal bagi pengembang yang menggunakan pustaka seperti Transformers, vLLM, atau SGLang.