فاز إطار عمل جديد قائم على جسر المزامنة للوكلاء المستخدمين للأدوات بالمسار الثاني من تقييم CAR-bench، محققاً نتيجة 60.0% في مقياس Pass@3 على مجموعة الاختبار المخفية الرسمية. يفصل النظام استدعاء النموذج عن عمليات الذهاب والإياب للأدوات من خلال إصدار النموذج لبرامج بايثون التي تتوقف وتستأنف عبر تبادلات المُقيّم.

  • يستخدم الوكيل وسيطاً مكوناً من مكالمتي نموذج مقابل سبع خطوات للوكيل لكل مهمة، مما يحل المهام بوسيط زمني قدره 1.8 ثانية من زمن استجابة النموذج على Cerebras gpt-oss-120b.
  • حقق أداءً يفوق الأساس الذي وضعه المنظم بمقدار 4.5 مرات بأقل تكلفة مُقدّرة وأسرع وسيط زمني لحل المهام (3.14 ثانية) بين الإدخالات التي تجاوزت هذا الأساس.
  • أعاد إطار العمل غير المُعدّل إنتاج نتيجة مطابقة قدرها 60.0% Pass@3 على GPT-5.5 في المسار المفتوح، متساوياً مع وكلاء النماذج المتقدمة.
  • خدم قالب ثابت واحد 78% من رموز الإدخال من ذاكرة التخزين المؤقت، مما قلل بشكل كبير من حسابات الإدخال الاسمية.

يفرض هذا النهج الامتثال بتكلفة استدلال صفرية من خلال تشفير السياسات الحتمية كمنطق في طبقة الأدوات بدلاً من قواعد القالب.