قامت Basis، وهي شركة وكلاء ذكاء اصطناعي للمحاسبين، بتقييم GPT-6 Astra الخاص بـ OpenAI مقابل GPT-5.6 Sol في مهمة معقدة لدفتر ضرائب مكون من 50 علامة تبويب. أظهر الاختبار أن GPT-6 Astra أكمل العمل في نصف الوقت وأظهر فهماً أعمق لنوايا المستخدم.
- استغرق GPT-6 Astra وقتاً أقل بنسبة 50% لإنهاء دفتر العمل المكون من 50 علامة تبويب مقارنة بـ GPT-5.6 Sol.
- لاحظت Basis تحسناً يقارب 20% في درجات التقييم الداخلي، مدفوعاً بتحسين التعرف على النوايا.
- يعدل النموذج حساب الاستدلال ديناميكياً بناءً على صعوبة المهمة مع الحفاظ على ذاكرته المؤقتة (الكاش).
- يمكن لـ GPT-6 Astra استنتاج التوقعات من سياق أوسع، مما يقلل الحاجة إلى قواعد صريحة.
يساعد التعديل الديناميكي للاستدلال في تقليل التكلفة وزمن الاستجابة، مما يجعل المهام طويلة التشغيل أكثر اقتصادية لـ Basis وعملائها.