लेखकों ने स्पेकुलेटिव्ह अनसर्टेंटी (SU) प्रस्तुत किया, एक तकनीक जो लॉगिट्स, वेट्स या एक्टिवेशन तक पहुंच की आवश्यकता के बिना केवल उनके आउटपुट टोकन का विश्लेषण करके ब्लैक-बॉक्स LLM एजेंट्स के लिए एक भविष्यसूचक विफलता सिग्नल को पुनः प्राप्त करती है। स्पेकुलेटिव्ह डिकोडिंग को उल्टा करके, एक छोटा ओपन-वेट ड्राफ्ट मॉडल एजेंट के ट्रेजेक्टरी का स्कोरिंग एकल फॉरवर्ड पास में करता है ताकि फेज-अवेयर फीचर्स निकाले जा सकें और उन्हें एक सत्यापनीय उद्देश्य के खिलाफ कैलिब्रेट किया जा सके।
- SU एक विफलता-संभावना स्कोर उत्पन्न करता है जिसे रूटिंग या मानव हस्तक्षेण जैसे डाउनस्ट्रीम पॉलिसी द्वारा उपयोग किया जा सकता है।
- इस विधि को Qwen3-Coder-480B और Claude 3.5 Sonnet एजेंट्स के लिए एक प्री-एक्जीक्यूशन वेटो गेट के रूप में इंस्टेंशिएट किया गया था।
- डिप्लॉयमेंट परिणामों ने एक्जीक्यूशन त्रुटि दर में 6-8 प्रतिशत बिंदुओं और टोकन लागत में 14-19% की कमी दिखाई है।
- यह दृष्टिकोण रीट्रेनिंग के बिना आउट-ऑफ-डिस्ट्रीब्यूशन बेंचमार्क्स पर स्थानांतरित होता है और विभिन्न एजेंट मॉडल के पार सामान्यीकृत होता है।
यह विधि महत्वपूर्ण एक्जीक्यूशन से पहले आत्मविश्वास वाली त्रुटियों का पता लगाने की अनुमति देती है, जिससे अधिक कुशल और विश्वसनीय एजेंटिक कोडिंग वर्कफ्लो संभव होते हैं।