एक स्वतंत्र शोधकर्ता क्राइप्टोग्राफी और सुरक्षा समुदाय में स्थापित लेखकों से एक प्रमाणन का अनुरोध कर रहा है ताकि वे "KavachBench: AI कोडिंग एजेंट्स में समस्या-आधारित प्रॉम्प्ट इंजेक्शन के खिलाफ निर्धारित नीति प्रवर्तन का एक व्यावहारिक मूल्यांकन" शीर्षक से एक पेपर arXiv पर जमा कर सकें।
अध्ययन Kavach का मूल्यांकन करता है, जो AI कोडिंग एजेंट्स के लिए नीति प्रवर्तन का एक Rust-आधारित निर्धारित रनटाइम है, IssueTrojanBench से प्रॉम्प्ट-इंजेक्शन हमलों के खिलाफ। मूल्यांकन में पाया गया कि आउट-ऑफ-बॉक्स नीतियों ने 88% दुर्भावनापूर्ण कार्यों को रोका, और परिष्कृत कवरेज 100% तक पहुंच गया, हालांकि लेखकों ने नोट किया है कि यह कॉरपस-विशिष्ट है, सामान्यीकरण का दावा नहीं।
शोधकर्ता ने सबमिशन प्रक्रिया को सुगम बनाने के लिए KavachBench के लिए एक GitHub रिपॉजिटरी और एक arXiv प्रमाणन कोड प्रदान किया है।