著者は Epistemic Shield を開発しました。これは、LLM の初期応答を最終出力ではなく暫定的な仮説として扱う実験的なフレームワークです。このシステムは回答を原子論的な主張に分解し、確率的な評価全体で一貫性を測定するために敵対的自己批判に付します。

  • 微細な分析のために応答を原子論的な主張に分解する。
  • 各主張を敵対的自己批判に付す。
  • 複数の確率的な評価全体で一貫性を測定する。
  • 利用可能な場合は外部証拠を組み込む。
  • 高リスク領域における根拠のない主張に非対称ペナルティを適用する。
  • モデルにすべて答えさせるのではなく、部分的な回答拒否を許可する。

著者は、このアーキテクチャが補正または幻覚耐性を改善するかをテストするために、技術的な批評、ベンチマークの提案、そして共同研究者を求めています。