एन्थ्रोपिक ने क्लॉड फेबल 5.1 जारी किया है, जो कोडिंग, ज्ञान कार्य और लंबे समय तक चलने वाली समस्या-समाधान कार्यों के लिए एक नया मानक स्थापित करने वाला मॉडल अपडेट है। इस रिलीज में नए Terminal-Bench-Science 0.1 बेंचमार्क पर महत्वपूर्ण प्रदर्शन लाभ उजागर हुए हैं, जहाँ फेबल 5.1 ने 52.6% स्कोर हासिल किया, जबकि फेबल 5 के लिए 24.7%, ओपस 5 के लिए 29.0% और जीपीटी-5.6 सोल के लिए 22.4% था।

  • क्लॉड फेबल 5.1 पांच तर्क स्तर पेश करता है: कम, मध्यम, उच्च, अत्यधिक उच्च और अधिकतम, जहाँ तर्क को पूरी तरह से अक्षम करने का कोई विकल्प नहीं है।
  • एक पेलिकन SVG जनरेशन प्रॉम्प्ट पर परीक्षण ने दिखाया कि कम और मध्यम प्रयास स्तरों ने तर्क ट्रेस को पूरी तरह से छोड़ दिया, जबकि उच्च स्तरों ने विस्तृत आंतरिक मनोगत उत्पन्न किए।
  • 'अधिकतम' तर्क स्तर के लिए 65,927 आउटपुट टोकन की आवश्यकता थी और कार्य के लिए $3.30 का खर्च आया, जिससे परीक्षण किए गए मॉडलों में सबसे विस्तृत दृश्य आउटपुट प्राप्त हुआ।
  • 'उच्च' सोच स्तर का उपयोग करके उत्पन्न SVG को एनिमेट करने में $1.37 का खर्च आया और घूमते हुए पहियों के साथ एक वीडियो बनाया गया, हालाँकि दिशा गलत थी।

यह अपडेट उपयोगकर्ताओं को विभिन्न तर्क प्रयास स्तरों पर मॉडल प्रदर्शन की तुलना करने की अनुमति देता है, यह उजागर करते हुए कि बढ़ी हुई कंप्यूटेशनल निवेश आउटपुट की गुणवत्ता और विस्तार को कैसे प्रभावित करता है।