著者は、インストール可能なClaudeスキルとしてパッケージ化された、モデル非依存のDESi認識論的ガバナンスフレームワークの実用的な応用であるDESi Reviewを公開しました。このツールは、決定論的な主張抽出とモデルに基づく裁定を分離することで、英語テキストに対して構造化された論文レビューパイプラインを実行します。
- システムは主張を正規の台帳に抽出し、Claudeを使用してそれらをSUPPORTED、OVERSTATED、UNSUPPORTED、またはNOT_A_CLAIMという4つの判断基準で評価します。
- 決定論的な層がスキーマ準拠、ハッシュ化、およびモデル呼び出しを行わずにリプレイ可能な状態を保証します。
- インストールには、有料のClaudeプラン、コード実行の有効化、および公開リポジトリをクローンするためのネットワークアクセスが必要です。
- 著者は、主張の検出と監査可能性の違いを測定するために、DESi Reviewと通常のLLMプロンプトを比較するA/Bテストを提案しています。
このプロジェクトは、決定論的な層が構造を制御するものの意味的な判断を保証するものではないことを認めつつ、明示的な認識論的アーキテクチャの変更が標準的なプロンプティングと比較してレビュー結果を変化させるかどうかを決定することを目指しています。