DeepSeek telah merilis DeepSeek-Coder-V2, sebuah model bahasa kode Mixture-of-Experts (MoE) sumber terbuka yang mencapai kinerja setara dengan GPT-4 Turbo dalam tugas-tugas spesifik pengkodean. Model ini dilatih lebih lanjut dari titik kontrol menengah DeepSeek-V2 menggunakan tambahan 6 triliun token.
- Meningkatkan kemampuan penalaran pemrograman dan matematika sambil mempertahankan kinerja bahasa umum.
- Memperluas dukungan bahasa pemrograman dari 86 menjadi 338 bahasa.
- Memperpanjang panjang konteks dari 16K menjadi 128K.
- Mengungguli model sumber tertutup seperti GPT-4 Turbo, Claude 3 Opus, dan Gemini 1.5 Pro dalam benchmark pemrograman dan matematika.
Rilis ini menyediakan alternatif sumber terbuka berkinerja tinggi untuk kecerdasan kode, menawarkan kemajuan signifikan dibandingkan pendahulunya DeepSeek-Coder-33B.