DeepSeek ने V4.1-Flash जारी किया है, जो अत्यंत निष्पादन दक्षता और कम लागत के लिए डिज़ाइन किया गया एक नया ओपन-वेट फ्लैगशिप मॉडल है। यह मॉडल सक्रिय कंप्यूटेशन और KV/cache लागत को काफी कम करने के लिए एक कारणिक एन्कोडर-डीकोडर आर्किटेक्चर का उपयोग करता है।

  • यह कृत्रिम विश्लेषण बुद्धि सूचकांक पर 40 अंक प्राप्त करता है, DeepSeek V4 Pro 0813 को पार करते हुए, जबकि प्रति 1M इनपुट टोकन की लागत $0.30 है।
  • इस आर्किटेक्चर में कुल 763B पैरामीटर हैं, जिनमें से केवल 8B इनपुट के लिए सक्रिय और 16B आउटपुट के लिए सक्रिय हैं।
  • यह 1M-टोकन संदर्भ विंडो का समर्थन करता है और MIT लाइसेंस के तहत टेक्स्ट और इमेज इनपुट दोनों को स्वीकार करता है।
  • स्वतंत्र मूल्यांकन दिखाते हैं कि यह AutomationBench-AA पर GPT-6 Astra के साथ 69% पर बराबरी करता है और AA-LCR v1.1 पर GPT-5.6 Sol के साथ 84% पर मिलता है।
  • उपयोगकर्ता रिपोर्ट करते हैं कि वे सामान्य हार्डवेयर पर स्थानीय रूप से मॉडल चला रहे हैं, जिसमें SSD स्ट्रीमिंग और ऑफलोडिंग के माध्यम से उच्च थ्रूपुट प्राप्त होता है।

रिलीज V4.1-Flash को प्रोप्राइटरी मॉडल्स के लिए एक लागत-प्रभावी विकल्प के रूप में स्थापित करती है, जो कीमत का एक अंश में मजबूत प्रदर्शन मापदंड प्रदान करता है।