अकाउंटेंट्स के लिए एक AI एजेंट कंपनी, Basis ने OpenAI के GPT-6 Astra का मूल्यांकन GPT-5.6 Sol के खिलाफ एक जटिल 50-टैब टैक्स वर्कबुक कार्य पर किया। टेस्ट ने दिखाया कि GPT-6 Astra ने आधा समय में काम पूरा किया और उपयोगकर्ता की इरादे को गहराई से समझने का प्रदर्शन किया।
- GPT-5.6 Sol की तुलना में GPT-6 Astra ने 50-टैब वर्कबुक को पूरा करने में 50% कम समय लिया।
- Basis ने आंतरिक मूल्यांकन स्कोर में लगभग 20% की सुधार देखा, जो बेहतर इरादा पहचान से प्रेरित था।
- मॉडल कार्य की कठिनाई के आधार पर तर्क की गणना को गतिशील रूप से समायोजित करता है जबकि अपने कैश को बनाए रखता है।
- GPT-6 Astra व्यापक संदर्भ से अपेक्षाओं का अनुमान लगा सकता है, जिससे स्पष्ट नियमों की आवश्यकता कम हो जाती है।
तर्क का गतिशील समायोजन लागत और प्रतिक्रिया समय को कम करने में मदद करता है, जिससे लंबे समय तक चलने वाले कार्य Basis और इसके ग्राहकों के लिए अधिक आर्थिक बन जाते हैं।