أطلقت أنثروبيك كلاود فابل 5.1، وهو تحديث للنموذج يحدد معياراً جديداً لمهام البرمجة، والعمل المعرفي، وحل المشكلات طويلة الأمد. وتبرز الإصدار مكاسب أداء كبيرة على معيار Terminal-Bench-Science 0.1 الجديد، حيث حقق Fable 5.1 نتيجة بنسبة 52.6%، مقارنة بـ 24.7% لـ Fable 5، و29.0% لـ Opus 5، و22.4% لـ GPT-5.6 Sol.
- يُدخل Claude Fable 5.1 خمسة مستويات للتفكير: منخفض، ومتوسط، وعالي، وxhigh، وmax، دون خيار لإيقاف التفكير تماماً.
- أظهر الاختبار على موجه توليد صورة SVG لطائر البليكان أن المستويين المنخفض والمتوسط تخطيا آثار التفكير بالكامل، بينما أنتجت المستويات الأعلى مونولوجات داخلية مفصلة.
- تطلّب مستوى التفكير 'max' 65,927 رمزاً ناتجاً وكلف $3.30 للمهمة، مما أسفر عن أكثر مخرجات بصرية تفصيلاً بين النماذج المختبرة.
- كلف تحريك صورة SVG المولّدة باستخدام مستوى التفكير 'high' مبلغ $1.37 وأنتج فيديو بعجلات دوارة، رغم أن الاتجاه كان خاطئاً.
يتيح التحديث للمستخدمين مقارنة أداء النموذج عبر مستويات جهد التفكير المختلفة، مما يكشف كيف يؤثر الاستثمار الحسابي المتزايد على جودة المخرجات وتفصيلها.