한 독립 연구원은 암호학 및 보안 커뮤니티의 저명한 저자들로부터 "KavachBench: AI 코딩 에이전트에서의 문제 기반 프롬프트 인젝션에 대한 결정론적 정책 집행의 실증 평가"라는 제목의 논문을 arXiv에 제출하기 위한 추천을 요청하고 있습니다.

이 연구는 IssueTrojanBench의 프롬프트 인젝션 공격에 대해 AI 코딩 에이전트를 위한 Rust 기반 결정론적 정책 집행 런타임인 Kavach를 평가합니다. 평가 결과, 기본 제공 정책은 악성 작업의 88%를 차단했으며, 정제된 커버리지는 100%에 도달했지만, 저자들은 이것이 코퍼스 특화적이며 일반화를 주장하는 것이 아니라고 명시했습니다.

연구자는 KavachBench를 위한 GitHub 저장소와 arXiv 추천 코드를 제공하여 제출 과정을 용이하게 했습니다.