بعد إصدار OpenAI لنظام Deep Research، أعاد فريق هندسة إطاره الوكيل (agentic) خلال 24 ساعة ونشر التنفيذ كمصدر مفتوح عبر مكتبة smolagents. يدمج النظام الناتج نموذج لغوي كبير (LLM) مع أدوات لتصفح الويب وفحص النصوص لأداء مهام الاستدلال متعدد الخطوات.
- يستخدم إعادة الإنتاج بنية "وكيل الكود"، مما يسمح للنموذج بالتعبير عن الإجراءات ككود بدلاً من JSON، مما يقلل استخدام الرموز (tokens) ويحسن معالجة الحالة.
- على مجموعة التحقق من GAIA، حقق النظام مفتوح المصدر 55.15%، متجاوزاً سابقة الحالة القصوى البالغة 46% التي كانت بحوزة Magentic-One.
- تتجاوز هذه الأداء بشكل ملحوظ نتيجة ~7% لنموذج GPT-4 المستقل على نفس المعيار، وتقترب من النتيجة المبلغ عنها من قبل OpenAI والبالغة 67.36%.
- يلاحظ الفريق أن التماثل الكامل مع OpenAI سيتطلب قدرات تفاعل متصفح أكثر تقدماً تتجاوز التنفيذ الحالي المقصور على النص فقط.
يعتبر المؤلفون هذا الأمر مهماً لأنه يوضح أن الأطر الوكيلية مفتوحة المصدر يمكنها تعزيز أداء النماذج اللغوية الكبيرة (LLM) بشكل كبير على معايير معقدة ومكثفة المعرفة دون الاعتماد على نماذج مملوكة.