يكشف مقارنة بين DeepSeek V4 Pro 0813 وClaude Fable 5 على معيار DeepSWE أن استراتيجية توجيه تستخدم كلا النموذجين تحل 82.7% من المهام بتكلفة 8.28 دولار لكل منهما، متفوقةً على استخدام Fable وحده (69.7%) وأرخص بكثير.

  • يتصدر Claude Fable 5 في دقة المحاولة الواحدة (69.7% pass@1) ويتفوق في Rust (85%) والأعمال كثيفة التعريف التسلسلي، لكن تكلفته 21.63 دولار لكل جولة تشغيل، أي حوالي 90 مرة أكثر من DeepSeek V4 Pro 0813.
  • يعد DeepSeek V4 Pro 0813 أرخص (0.24 دولار لكل جولة تشغيل) ويحقق دقة أعلى مع محاولات متعددة (88.5% pass@4 مقابل 84.1% لـ Fable)، مما يجعله الخيار الأفضل للعمليات عالية الحجم أو التي تتحمل إعادة المحاولة.
  • يُظهر النموذجان ارتباطاً منخفضاً لكل مهمة (0.39)، حيث يغطيان 107 من أصل 113 مهمة بينهما، وهو ما يبرر نهج التسلسل: تشغيل Pro أولاً وتصعيد المهمة إلى Fable فقط عند الضرورة.

تشير التحليلات إلى أن Fable 5 يُستخدم بشكل أفضل كتصعيد انتقائي لمجالات محددة مثل Rust بدلاً من كونه النموذج الافتراضي، بينما يوفر DeepSeek V4 Pro 0813 دقة قريبة من دقة Fable بكسر بسيط من التكلفة.