शोधकर्ताओं ने DUP (Deeply Understanding the Problems) प्रस्तावित किया, एक विधि जिसे बड़े भाषा मॉडलों की गणितीय शब्द समस्याओं को हल करने की क्षमता को सुधारने के लिए डिज़ाइन किया गया है, जो अक्सर Chain-of-Thought तर्क को सीमित करते हैं, उन अर्थ-संबंधी गलतफहमी की त्रुटियों को दूर करके।
- DUP मॉडलों को समस्याओं को गहराई से समझने और बेहतर तर्क के लिए मुख्य जानकारी निकालने के लिए प्रोत्साहित करता है।
- विधि 10 विविध तर्क बेंचमार्क्स में प्रतिद्वंद्वियों का लगातार सामना करती है।
- DUP ने zero-shot सेटिंग में GSM8K बेंचमार्क पर 97.1% की नई राज्य-शীर्ष सटीकता हासिल की।
यह दृष्टिकोण LLM तर्क प्रदर्शन को सीमित करने वाले एक प्रमुख कारक को हल करता है, जो गणना या चूक गए चरणों की त्रुटियों के बजाय अर्थ-समझ पर केंद्रित है।