تقيّم دراسة بعنوان "التباعد في السياسات المعرفية خلال تلوث نماذج اللغات الكبيرة متعددة الأدوار: تحقيق تدرج البروتوكول" كيفية تعامل نماذج اللغات الكبيرة مع المقدمات الخاطئة المُحقَنة في سجل المحادثة، وهي حالة فشل تُعرف بالتلوث على مستوى الجلسة. اختبر الباحثون GPT-5.4 Mini وGemini-3.1 Flash-Lite وGLM-4.5-Air عبر عشرة مجالات معرفية باستخدام 22,500 دور عند درجة حرارة صفر.

  • أظهرت GPT-5.4 Mini سياسة مستقلة عن المحتوى مع عدم اعتماد أي مقدمات خاطئة عبر جميع الجلسات الخمسمائة.
  • اتبع Gemini-3.1 Flash-Lite تدرجاً سلطوياً حاداً، حيث تراوحت معدلات الاعتماد من 0.1% للأخطاء المنسوبة إلى الذات إلى 94.0% عند تجاوز التعليمات.
  • أظهرت GLM-4.5-Air تدرجاً أقل انحداراً (15.8% مقابل 84.2%) وتعافت في 94.5% من الجلسات المتأثرة، مقارنة بـ60.0% فقط لـGemini.

يخلص المؤلفون إلى أن سجل المحادثة يعمل كسطح هجوم غير موثوق يتطلب تصميماً واعياً بالأصل، وقد أصدروا الإطار الكامل كمعيار مفتوح المصدر.