一位独立研究人员正在请求密码学和安全性社区的知名作者为其提交题为“KavachBench:针对AI编码代理中基于问题的提示注入的确定性策略执行的实证评估”的论文到arXiv提供背书。

该研究评估了Kavach(一种用于AI编码代理的基于Rust的确定性策略执行运行时)针对IssueTrojanBench中的提示注入攻击。评估发现,开箱即用的策略阻止了88%的恶意行为,细化覆盖率达到100%,尽管作者指出这是特定于语料库的,而非泛化能力的声明。

该研究人员提供了KavachBench的GitHub仓库和arXiv背书代码以促进提交过程。