DeepSeek ने DeepSeek-V4-Flash के लिए एक अपडेटेड पब्लिक-बेटा API जारी की, जिसके साथ तुरंत ओपन-वेट्स उपलब्धता भी शुरू हुई, जो आर्किटेक्चरल बदलावों के बजाय पोस्ट-ट्रेनिंग के माध्यम से हासिल किए गए महत्वपूर्ण प्रदर्शन वृद्धि को दर्शाती है। मॉडल अपनी 284B कुल / 13B सक्रिय पैरामीटर संरचना को बनाए रखता है, लेकिन एजेंटिक क्षमताओं और कोडिंग बेंचमार्क्स में महत्वपूर्ण सुधार दिखाता है।
- DeepSeek-V4-Flash API अपग्रेडेड एजेंट क्षमताओं के साथ लॉन्च हुई, जो V4-Pro-Preview से आगे निकलती है, Responses API फॉर्मेट का समर्थन करती है और Codex के लिए अनुकूलित है।
- Terminal-Bench स्कोर 56.9 से बढ़कर 82.7 (+25.8 अंक) हो गया, जबकि GDPval-AA v2 Elo में मॉडल आकार या आर्किटेक्चर में कोई बदलाव किए बिना 1189 से 1559 तक वृद्धि हुई।
- ओपन वेट्स MIT लाइसेंस के तहत जारी किए गए, जिनमें 256 राउटेड एक्सपर्ट्स और प्रति टोकन 6 सक्रिय एक्सपर्ट्स शामिल हैं, साथ ही एक DSpark स्पेकुलेटिव डिकोडिंग मॉड्यूल भी है।
- इस रिलीज ने कीमतों में बढ़ती प्रतिस्पर्धा को तेज किया, DeepSeek को बुद्धिमत्ता बनाम लागत पैरेटो फ्रंटियर पर $0.14/$0.28 प्रति 1M टोकन और 98% कैश-हिट डिस्काउंट के साथ स्थित किया।
यह अपडेट दिखाता है कि पोस्ट-ट्रेनिंग ऑप्टिमाइजेशन जटिल कार्यों के लिए मॉडल उपयोगिता को महत्वपूर्ण रूप से बढ़ा सकते हैं, जबकि प्रोप्राइटरी विकल्पों के मुकाबले प्रतिस्पर्धात्मक कीमत बनाए रखते हैं।