DeepSeek ने आधिकारिक तौर पर DeepSeek V4.1 Flash मॉडल जारी किया है, जो अपने नए आर्किटेक्चर श्रृंखला में सबसे छोटा प्रवेश बिंदु है और जिसमें नेटिव मल्टीमोडल विज़ुअल समझ शामिल है। Causal-Encoder-Decoder डिज़ाइन पर निर्मित, यह एक 552B-पैरामीटर Mixture of Experts (MoE) मॉडल है जो इनपुट साइड पर केवल 8B पैरामीटर और आउटपुट साइड पर 16B सक्रिय करता है।
- असममित आर्किटेक्चर समान आकार के ज्ञात मॉडलों की तुलना में इनफरेंस लागत को काफी कम करता है।
- KV कैश कंप्रेशन HBM आवश्यकताओं को 1/4 और SSD आवश्यकताओं को पिछली पीढ़ी के 1/8 तक कम कर देता है, जिससे एजेंट-स्टाइल कार्यों की लागत कम होती है।
- बेंचमार्क टेस्टिंग दिखाती है कि V4.1 Flash DeepSeek V4 Pro सहित फ्लैगशिप मॉडलों के बुद्धि स्तर को पार कर जाता है।
- मॉडल अब `deepseek-flash` नाम से DeepSeek API पर लाइव है, और पुराने V4 Flash वेरिएंट्स को अस्थायी रूप से इसके लिए रूट किया गया है।
- प्राइसिंग में पीक/ऑफ-पीक दरों के साथ समायोजन किया गया है, और 14 सितंबर 2026 के बाद `deepseek-v4-pro` को अनुरोध V4.1 Flash की ओर रूट किए जाएंगे।
नई आर्किटेक्चर अधिक क्षमता छत, तेज इनफरेंस, उच्च थ्रूपुट और बड़े-पैरामीटर मॉडलों के लिए स्केलेबिलिटी प्रदान करने का लक्ष्य रखती है, जबकि कम लागत में अधिक उपयोगकर्ताओं की सेवा करती है।