DeepSeek ने DeepSeek-V3-0324 जारी किया है, जो एक मॉडल अपडेट है जिसने अपने पूर्ववर्ती DeepSeek-V3 की तुलना में विशेष रूप से तर्कशक्ति क्षमताओं, कोड निष्पादन योग्यता और चीनी लेखन पटुता में उल्लेखनीय सुधार दिखाए हैं।

  • MMLU-Pro स्कोर 75.9 से बढ़कर 81.2 हो गया है, GPQA 59.1 से 68.4 तक, AIME 39.6 से 59.4 तक, और LiveCodeBench 39.2 से 49.2 तक।
  • सुधारित कोड निष्पादन योग्यता और सौंदर्यशास्त्र के साथ फ्रंट-एंड वेब डेवलपमेंट आउटपुट में वृद्धि।
  • R1 के अनुरूप चीनी लेखन शैली को अनुकूलित किया है और मध्यम से लंबी अवधि की सामग्री की गुणवत्ता में सुधार किया है।
  • पिछले V3 संस्करणों में मौजूद फंक्शन कॉलिंग सटीकता समस्याओं को ठीक किया है और बहु-चरणीय इंटरैक्टिव पुनर्लेखन को बढ़ावा दिया है।

इस अपडेट ने Transformers, vLLM, या SGLang जैसे लाइब्रेरी का उपयोग करने वाले डेवलपर्स के लिए बेहतर बेंचमार्क प्रदर्शन और अधिक विश्वसनीय फंक्शन कॉलिंग प्रदान की है।