作者发布了 DESi Review,这是模型独立的 DESi 认识论治理框架的一个实际应用,打包为可安装的 Claude 技能。该工具通过将确定性主张提取与基于模型的裁决分离,对英文文本执行结构化的论文评审流程。
- 系统将主张提取到规范账本中,并使用 Claude 根据四种裁决对其进行评估:SUPPORTED、OVERSTATED、UNSUPPORTED 或 NOT_A_CLAIM。
- 一个确定性层确保模式合规性、哈希处理和可重放稳定状态,且自身不进行模型调用。
- 安装需要付费的 Claude 计划、启用代码执行以及访问网络以克隆公共仓库。
- 作者提议进行 A/B 测试,将 DESi Review 与普通 LLM 提示词进行比较,以衡量在主张检测和可审计性方面的差异。
该项目旨在确定显式的认识论架构是否改变了评审结果,与标准提示词相比,同时承认确定性层控制结构但并不能使语义判断绝对无误。