नया DeepSeek V4-Flash मॉडल ArtificialAnalysis इंडेक्स पर 50 अंक प्राप्त करने में सफल रहा है। इस परिणाम के आधार पर यह GLM-5.2 और GPT-5.6 Luna से केवल एक अंक नीचे है।
ArtificialAnalysis इंडेक्स में DeepSeek V4-Flash ने 50 हासिल किए
Benchmarks
| Benchmark | मॉडल | स्कोर |
|---|---|---|
| Artificial Analysis Intelligence Index | DeepSeek V4-Flash | 50% |
बेंचमार्क, लाइसेंस और सर्विंग लागत पर Kimi K3, DeepSeek V4 Pro और GLM-5.2 की तुलना
तीन ओपन-वेट स्पर्स मिक्स्चर-ऑफ-एक्सपर्ट्स मॉडल्स—Moonshot AI का Kimi K3, DeepSeek V4 Pro, और Zhipu AI का GLM-5.2—की तुलना लंबे समय तक चलने वाले कोडिंग और एजेंट वर्कलोड के लिए उनकी क्षमताओं, लाइसेंस शर्तों और सर्विंग लागत के आधार पर की गई है।
Base-10 का चार्ली ओ'नील कहता है कि Kimi और GLM, Opus 5 से बेहतर हैं
Dwarkesh Patel के साथ एक हालिया एपिसोड में Base-10 के चार्ली ओ'नील ने चर्चा की कि Kimi और GLM मॉडल "लगभग वस्तुनिष्ठ रूप से" Opus 5 से बेहतर क्यों हैं।
DeepSeek V4.1 Flash ने Artificial Analysis Intelligence Index v4.3 में शीर्ष स्थान हासिल किया
DeepSeek V4.1 Flash ने Artificial Analysis Intelligence Index v4.3 अपडेट के नए Astra बेंचमार्क पर पहले स्थान पर कब्जा कर लिया है।
LiveBench में DeepSeek v4.1 Flash जोड़ा गया
LiveBench बेंचमार्किंग प्लेटफ़ॉर्म ने अपने मूल्यांकन सूट में DeepSeek v4.1 Flash मॉडल जोड़ दिया है।
GLM-5.3 Flash distillation स्थिरता का व्यापार 17x लागत कमी के लिए करता है
DeepSWE बेंचमार्क पर GLM-5.3 और इसके डिस्टिल्ड वेरिएंट, GLM-5.3 Flash की तुलना दर्शाती है कि डिस्टिलेशन कोर कोडिंग क्षमता को बनाए रखते हुए रोलआउट लागत को काफी कम करता है। पूर्ण मॉडल $3.99 प्रति कार्य पर 69.0% pass@1 दर प्राप्त करता है, जबकि Flash वेरिएंट केवल $0.24 पर 63.4% स्कोर करता है, जो 17x कीमती कमी का प्रतिनिधित्व करता है।