सिएरा रिसर्च ने τ-bench 1.0.1 जारी किया, जो `banking_knowledge` कार्य के ग्रेडिंग योजना को ठीक करता है ताकि सावधान सत्यापन पढ़ाई के लिए एजेंटों को दंडित करना बंद हो जाए और कई डेटा असंगतियों को ठीक किया जाए। अपडेट यह सुनिश्चित करता है कि री-ग्रेडिंग लीडरबोर्ड ट्रैजेक्ट्री केवल स्कोर बढ़ाती है, बिना किसी पहले पास होने वाले सिमुलेशन को विफल किए।

  • अतिरिक्त डेटाबेस पढ़ने कॉल जो गोल्डन ट्रैजेक्ट्री में नहीं थे, अब DB-हैश तुलना को दूषित करके रिवार्ड को शून्य नहीं करते हैं।
  • संख्यात्मक टूल तर्कों को सामान्य किया गया है ताकि पूर्णांक बनाम फ्लोट स्पेलिंग निर्धारक रिकॉर्ड आईडी को न बदले।
  • कार्य 077–086 के लिए गोल्ड ट्रैजेक्ट्री अब खोए/चुराए गए कार्ड परिदृश्यों के लिए आवश्यक पढ़ाई शामिल करते हैं।
  • बैंक खाता लेनदेन आउटपुट को सही टाई-ब्रेकर हल करने के लिए तिथि के अनुसार अवरोही क्रम में व्यवस्थित किया गया है।
  • प्लैटिनम रिवार्ड्स ज्ञान दस्तावेज़ में विरोधाभासी कैशबैक दरों और कार्य_074 में अतिरिक्त एटीएम शुल्क को ठीक किया गया है।

री-ग्रेड सभी मॉडलों के लिए ऊपर की ओर स्कोर गति दिखाता है, जिसमें gpt-5-5 ने 9.02 pass^1 अंक प्राप्त किए हैं। उपयोगकर्ता नए `--fresh-tasks` फ्लैग का उपयोग करके अपने परिणामों को फिर से ग्रेड कर सकते हैं या पिछले स्कोर की पुनरावृत्ति के लिए `pre-v1.0.1` टैग पर पिन कर सकते हैं।