يقدم الباحثون Recuris، وهو بنية ذاكرة عمل تجريبية تكرارية مصممة لمعالجة تحديات التحسين الذاتي التكراري في المهام طويلة المدى. يستخدم النظام ذاكرة العمل لتتبع التقدم وتوجيه اختيار المهارات من الذاكرة التجريبية، مما يخلق حلقة محدودة تُحدّد نقاط الفشل وتحديث المهارات بناءً على الاحتياجات الحالية.
- يحسّن Recuris نجاح المهمة في 35 من أصل 37 زوجًا مكتملاً من النماذج والمعايير عبر أربعة معايير.
- على tau-bench، يضيف +17.8 نقطة إلى GPT-5.6 Sol و+15.6 إلى Claude Opus 5، ليصل إلى 87.9%.
- يضيف +16.6/+13.5 نقطة على Qwen3.6-27B/35B في SkillFlow.
- يتسع التفوق مع نمو أفق التفاعل، مضافًا +32.2 نقطة في أطول المهام.
- تقلل الفشل الشائع طويل المدى بنسبة تصل إلى 80%.
يضع هذا النهج الذاكرة المتطورة تكراريًا كأساس قابل للتوسع للتحسين الذاتي التكراري، مما يمكّن الوكلاء من تحويل الخبرة المتراكمة باستمرار إلى سلوك أكثر فعالية.