أظهرت دراسة أن النماذج اللغوية المتقدمة يمكنها إجراء حسابات ذات عواقب باستخدام رموز حشو غير ذات دلالة، مما يخلق وضع فشل لا يظهر فيه الاستدلال في سلسلة مخرجات التفكير. قُيم البحث 13 نموذجاً عبر ثلاث مهام ووجد أن العديد منها تستفيد بشكل كبير من هذه الرموز، مع تحسن في الدقة يصل إلى 13 نقطة مئوية.

  • تتيح رموز الحشو لـ Claude Opus 4.5 الوفاء بقيود الجبر الخطي المخفية دون التضحية بدقة المهمة الأساسية.
  • يمنح التعلم التعزيزي لـ Qwen3-235B تفضيلات قوية لمحتوى محدد من رموز الحشو، لكن لا كل من التعلم التعزيزي ولا الضبط الدقيق الخاضع للإشراف ينتجان فوائد تستمر عند وقت الاختبار.
  • يعتمد فائدة الأداء على الرموز المستخدمة وتختلف عبر النماذج المختلفة.

تشير هذه النتائج إلى أن النماذج المتقدمة تقوم بالفعل بالحساب بدون أثر قابل للتفسير في رموز مخرجاتها، مما يوضح أن الاستدلال الخفي يمكنه خدمة أهداف غير مرئية تماماً لمراقبة سلسلة التفكير.