Un chercheur indépendant demande le parrainage d'auteurs établis dans la communauté de la cryptographie et de la sécurité pour soumettre un article intitulé « KavachBench : Une évaluation empirique de l'application déterministe de politiques contre l'injection de prompts basée sur des problèmes dans les agents de codage IA » à arXiv.

L'étude évalue Kavach, un runtime d'application de politiques déterministe basé sur Rust pour les agents de codage IA, contre les attaques par injection de prompts d'IssueTrojanBench. L'évaluation a révélé que les politiques out-of-the-box ont bloqué 88 % des actions malveillantes, et que la couverture affinée a atteint 100 %, bien que les auteurs notent qu'il s'agit d'un corpus spécifique et non d'une affirmation de généralisation.

Le chercheur a fourni un dépôt GitHub pour KavachBench et un code de parrainage arXiv pour faciliter le processus de soumission.