Seorang peneliti independen meminta dukungan dari penulis mapan di komunitas kriptografi dan keamanan untuk mengirimkan makalah berjudul "KavachBench: Evaluasi Empiris Penegakan Kebijakan Deterministik Terhadap Injeksi Prompt Berbasis Masalah pada Agen Kode AI" ke arXiv.

Studi ini mengevaluasi Kavach, runtime penegakan kebijakan deterministik berbasis Rust untuk agen kode AI, terhadap serangan injeksi prompt dari IssueTrojanBench. Evaluasi menemukan bahwa kebijakan bawaan memblokir 88% tindakan berbahaya, dan cakupan yang disempurnakan mencapai 100%, meskipun penulis mencatat ini spesifik pada korpus dan bukan klaim generalisasi.

Peneliti tersebut telah menyediakan repositori GitHub untuk KavachBench dan kode dukungan arXiv untuk memfasilitasi proses pengiriman.