DeepSWE बेंचमार्क पर DeepSeek V4 Pro 0813 और Claude Fable 5 की तुलना से पता चलता है कि दोनों मॉडलों का उपयोग करने वाली एक रूटिंग रणनीति प्रत्येक $8.28 में कार्यों के 82.7% को हल करती है, जो अकेले Fable (69.7%) की तुलना में बेहतर है और काफी सस्ती भी है।
- Claude Fable 5 एकमात्र प्रयास में सटीकता (69.7% pass@1) में शीर्ष पर है और Rust (85%) और सीरियलाइजेशन-भारी कार्यों में उत्कृष्ट है, लेकिन इसकी लागत रोलआउट प्रति $21.63 है, जो DeepSeek V4 Pro 0813 की तुलना में लगभग 90 गुना अधिक है।
- DeepSeek V4 Pro 0813 सस्ता है (रोलआउट प्रति $0.24) और कई प्रयासों के साथ उच्च सटीकता प्राप्त करता है (Fable के 84.1% की तुलना में 88.5% pass@4), जो उच्च-वॉल्यूम या पुनः प्रयास-सहज कार्यों के लिए बेहतर मूल्य प्रदान करता है।
- मॉडलों के बीच प्रति-कार्य सहसंबंध कम (0.39) है, और वे 113 कार्यों में से 107 को कवर करते हैं, जो एक कैस्केड दृष्टिकोण का समर्थन करता है: Pro को पहले चलाना और केवल आवश्यक होने पर Fable पर स्केलेट करना।
विश्लेषण सुझाव देता है कि Fable 5 को Rust जैसे विशिष्ट डोमेन के लिए चयनात्मक एस्केलेशन के रूप में उपयोग किया जाना चाहिए, न कि डिफ़ॉल्ट मॉडल के रूप में, जबकि DeepSeek V4 Pro 0813 लागत का एक अंश पर Fable-जैसी सटीकता प्रदान करता है।