DeepSeek telah merilis DeepSeek-Coder-V2, sebuah model bahasa kode Mixture-of-Experts (MoE) sumber terbuka yang mencapai kinerja setara dengan GPT-4 Turbo dalam tugas-tugas spesifik pengkodean. Model ini dilatih lebih lanjut dari titik kontrol menengah DeepSeek-V2 menggunakan tambahan 6 triliun token.

  • Meningkatkan kemampuan penalaran pemrograman dan matematika sambil mempertahankan kinerja bahasa umum.
  • Memperluas dukungan bahasa pemrograman dari 86 menjadi 338 bahasa.
  • Memperpanjang panjang konteks dari 16K menjadi 128K.
  • Mengungguli model sumber tertutup seperti GPT-4 Turbo, Claude 3 Opus, dan Gemini 1.5 Pro dalam benchmark pemrograman dan matematika.

Rilis ini menyediakan alternatif sumber terbuka berkinerja tinggi untuk kecerdasan kode, menawarkan kemajuan signifikan dibandingkan pendahulunya DeepSeek-Coder-33B.