Claude Code v2.1.181 में /config thinking=false जैसे प्रॉम्प्ट सिंटैक्स के माध्यम से कॉन्फ़िगरेशन सेटिंग्स सेट करने का समर्थन जोड़ा गया है, macOS पर सैंडबॉक्स Apple इवेंट्स का समर्थन जोड़ा गया है, और स्ट्रीमिंग, ऑटो-रीट्राई और सबएजेंट व्यवहार में सुधार किया गया है। यह प्लेटफ़ॉर्मों के बीच स्टार्टअप, फ़ाइल हैंडलिंग, क्लिपबोर्ड और UI प्रतिक्रियाशीलता से जुड़ी कई बग को भी ठीक करता है।
Claude Code v2.1.181 रिलीज नोट्स
Claude Code बिलिंग अध्ययन दिखाता है कि संदर्भ में कमी लागत को कम नहीं करती
2,848 प्रदाता-बिल किए गए Claude Code रनों के एक अध्ययन से पता चलता है कि पुनर्प्राप्त संदर्भ या टूल आउटपुट को कम करने से कोडिंग एजेंटों की वास्तविक बिल किए गए लागत में विश्वसनीय रूप से कमी नहीं आती है। शोध ने तीन मॉडलों और सात रिपॉजिटरीज़ पर 2,908 निष्पादन के अभियान का विश्लेषण करके पाठ हटाने की सामान्य मूल्यांकन मेट्रिक को चुनौती दी है।
फॉलो-अप: 2x RTX PRO 6000 पर DeepSeek V4 Flash वास्तविक कोडिंग कार्यों को Sonnet और Opus से तेजी से समाप्त करता है, लगभग Sonnet गुणवत्ता के साथ
एक फॉलो-अप बेंचमार्क दो RTX PRO 6000 GPU पर vLLM का उपयोग करके चल रहे DeepSeek V4 Flash का मूल्यांकन करता है, Claude Sonnet और Opus जैसे API-आधारित मॉडल के साथ वास्तविक कोडिंग कार्यों में इसके प्रदर्शन की तुलना करता है। अध्ययन पाता है कि हालांकि Opus और Fable श्रेष्ठ कोड गुणवत्ता बनाए रखते हैं, DeepSeek V4 Flash महत्वपूर्ण रूप से तेज वॉल-क्लाक समय के साथ लगभग Sonnet-स्तर की गुणवत्ता प्राप्त करता है।
TestEvo-Bench: टेस्ट और कोड सह-विकास के लिए एक एक्जीक्यूटेबल और लाइव बेंचमार्क
लेखकों ने TestEvo-Bench पेश किया है, जो एक लाइव बेंचमार्क है जिसे कोड और टेस्ट की सह-विकास को कैसे संभालते हैं, इसका मूल्यांकन करने के लिए डिज़ाइन किया गया है। यह वास्तविक commit इतिहास और environment कॉन्फ़िगरेशन से जुड़े एक्जीक्यूटेबल टास्क प्रदान करके मौजूदा बेंचमार्क की सीमाओं को दूर करता है।
Claude Code v2.1.235 में वर्तनी जाँच की सुविधा जोड़ी गई, प्रॉम्प्ट कैश और UI बग ठीक किए गए
Claude Code संस्करण 2.1.235 में प्रॉम्प्ट इनपुट के लिए एक वैकल्पिक वर्तनी जाँच सुविधा पेश की गई है और प्रॉम्प्ट कैशिंग, UI संरेखण और अनुमति डायलॉग से जुड़ी कई समस्याओं को हल किया गया है।
DeepSWE पर DeepSeek V4 Pro 0813 बनाम Claude Fable 5: लागत, कोडिंग और रूटिंग
DeepSWE बेंचमार्क पर DeepSeek V4 Pro 0813 और Claude Fable 5 की तुलना से पता चलता है कि दोनों मॉडलों का उपयोग करने वाली एक रूटिंग रणनीति प्रत्येक $8.28 में कार्यों के 82.7% को हल करती है, जो अकेले Fable (69.7%) की तुलना में बेहतर है और काफी सस्ती भी है।