يُعد ProvenanceGuard طبقة تحقق ما بعد التوليد لوكلاء بروتوكول سياق النموذج (MCP)، تكتشف خلط المصادر عبر التأكد من إسناد الادعاءات إلى مصدر الأدلة الصحيح. يحلل النظام مسارات MCP الملتقطة دون إعادة تدريب الوكيل، حيث يقسم الإجابات إلى ادعاءات ويتحقق من تطابق مصدر الدعم مع المصدر المذكور أو الضمني في المخرجات.

  • التقط ProvenanceGuard 138 من أصل 139 ادعاءً اعتبرها خبراء بشريون غير مدعومة، بينما حدد المصدر الصحيح بنسبة 86% تقريباً من الوقت.
  • في اختبار مع مصادر متشابهة، حقق درجة F1 بلغت 0.846 لقرارات الحظر، وحدد المصادر الدقيقة في 50.3% من الحالات.
  • اكتشف بنجاح جميع حالات الإسناد الخاطئ البالغ عددها 50، حيث تم تبديل المصدر المذكور بينما بقيت الأدلة سليمة.
  • يدمج النظام حلقة إصلاح على طراز RARR أنهت جميع الإجابات المحظورة، رغم أن العديد منها أدى إلى نصوص احتياطية آمنة بدلاً من إعادة صياغة جوهرية.

يعالج هذا النهج قصور درجات الموثوقية بجعل نسب الإسناد مرئية ادعاءً تلو الآخر، وهو أمر حاسم في الإعدادات الحساسة للبيانات حيث يمكن أن يكون الإسناد الخاطئ بنفس ضرر الوقائع غير الصحيحة.