该文质疑基于概率的大语言模型(LLM)防御者是否足以减少安全领域的“灰色地带”不确定性,并认为不应仅基于概率授权操作。为解决这一问题,作者构建了 EGA V9,一个旨在为可信自主代理提供确定性运行时治理的系统。

EGA V9 的运作原则是:如果某个操作在最终执行边界上无法被验证为允许,则不得执行。作者邀请反馈,指出该方法的推理、实现或执行边界可能在何处失效。