حققت تراسي المركز الأول في معيار GAIA الخاص بـ Hugging Face، وهو اختبار يقيس قدرات وكلاء الذكاء الاصطناعي في العالم الحقيقي بما في ذلك الاستدلال واستخدام الأدوات، متفوقة على المشاركات من Meta وMicrosoft وغيرها.
- حققت تراسي معدل نجاح إجمالي بنسبة 35.55% في المعيار المكون من أكثر من 450 سؤالاً.
- يستخدم النظام التحسين الذاتي التكراري عبر STaR (Self-Taught Reasoner) المُضبط بدقة على مسارات إجراءات تشبه البشر.
- تعزز إجراءات LLM الأساسية بالكود لتكوين استدعاءات أدوات متعددة في إجراء كود واحد.
- يقوم وكيل المستوى الأعلى بمراجعة الذات لتحديد ما إذا كانت المعلومات كافية قد تم جمعها قبل التبديل بين الأدوات أو استدعاء وكلاء متخصصين.
تذكر المقالة أن 90% proficiency يُعتبر العتبة لاستبدال البشر في المهام المعقدة، وهو هدف تسعى إليه تراسي.