DeepSeek ने DeepSeek-Coder-V2 जारी किया है, जो एक ओपन-सोर्स मिक्स्चर-ऑफ-एक्सपर्ट्स (MoE) कोड लैंग्वेज मॉडल है जो कोड-विशिष्ट कार्यों में GPT-4 Turbo के तुल्य प्रदर्शन प्राप्त करता है। मॉडल को DeepSeek-V2 के एक इंटरमीडिएट चेकपॉइंट से अतिरिक्त 6 ट्रिलियन टोकन का उपयोग करके आगे प्री-ट्रेन किया गया है।
- सामान्य भाषा प्रदर्शन बनाए रखते हुए कोडिंग और गणितीय तर्कशक्ति की क्षमताओं में वृद्धि करता है।
- 86 से 338 भाषाओं तक प्रोग्रामिंग भाषा समर्थन का विस्तार करता है।
- संदर्भ लंबाई को 16K से 128K तक बढ़ाता है।
- कोडिंग और गणित बेंचमार्क्स में GPT-4 Turbo, Claude 3 Opus और Gemini 1.5 Pro जैसे बंद-स्रोत मॉडलों को हराता है।
यह रिलीज़ कोड इंटेलिजेंस के लिए एक उच्च-प्रदर्शन ओपन विकल्प प्रदान करती है, जो अपने पूर्ववर्ती DeepSeek-Coder-33B की तुलना में महत्वपूर्ण प्रगति प्रस्तुत करती है।