يتفوق Claude Opus 5 بشكل ملحوظ على Claude Opus 4.8 في جميع المجالات، مع أكبر التحسينات في البرمجة الوكيلية، واستخدام الحاسوب، وأعمال المعرفة طويلة المدى. ويضع معياراً جديداً للأداء المتفوق في عدة معايير مستقلة، ويكون مقارباً أو متقدماً على Claude Fable 5 وClaude Mythos 5 في العديد من التقييمات.

  • يُروّج لـ Opus 5 بأنه بنفس جودة Fable 5 أو أفضلها في المهام العملية، مع كونه أسرع وأرخص بنصف السعر.
  • تجنب النموذج عمداً التدريب على المهام المتعلقة بالسيبرانية، مما يعني أنه يفتقر إلى القدرة الكاملة للهجوم السيبراني المعقد الموجودة في نماذج فئة Mythos.
  • في تقييمات علم الفيروسات، يبدو Opus 5 أفضل قليلاً من Mythos 5، لأن هذه المهام تتضمن خطوات فردية بدلاً من استدلال واسع النطاق.
  • تصنف ArtificialAnalysis Opus 5 عند أعلى مستوى جديد يبلغ 61، وتقدير نقطة Anthropic ECI هو 162.1، مما يضعه على خط اتجاه Mythos.

تشير المقالة إلى أن الحفاظ على حجم Opus وتجنب التدريب السيبراني يوفر وقتاً للدفاعيين للوصول إلى أدوات متفوقة مع مصنفات تُفعّل بنسبة أقل بـ 85% من Fable.