制御実験により、プレフィックス付きアンカープロンプトを使用することで、「沈黙失敗」—出力は意味的に一貫しているものの物理的現実から逸脱する現象— がロングチェーンエージェントの反復において緩和されることが示された。本研究では、主要なTransformerモデルにおいて、アンカー制約の有無によるレシピ生成の80ラウンドを比較した。
- コントロールグループの出力は80回の反復後に物理的限界に反するものとなった(例:7°Cの油、ナノメートルのスライス)。
- 実験グループの出力は物理則の境界内に留まり、産業グレードの標準化されたソリューションへと収束した。
- コントロールグループのトークン量は無効なコンテンツにより約1倍増加した一方、実験グループは展開可能なエンジニアリングコンテンツにより約7倍に拡大した。
- アンカープロンプトはモデルアーキテクチャの変更や追加推論パイプラインを必要としない純粋な外部ソリューションである。
このアプローチは事後の事実検証コストを削減し、測定可能な計算オーバーヘッドなしで生産グレードのロングチェーンエージェントの信頼性の高い展開を可能にする。