Um pesquisador independente está solicitando um endosso de autores estabelecidos na comunidade de criptografia e segurança para submeter um artigo intitulado "KavachBench: Uma Avaliação Empírica da Aplicação Determinística de Políticas Contra Injeção de Prompt Baseada em Problemas em Agentes de Código IA" ao arXiv.
O estudo avalia o Kavach, um tempo de execução determinístico baseado em Rust para aplicação de políticas em agentes de código IA, contra ataques de injeção de prompt do IssueTrojanBench. A avaliação encontrou que políticas padrão bloquearam 88% das ações maliciosas, e a cobertura refinada atingiu 100%, embora os autores notem que isso é específico do corpus e não uma afirmação de generalização.
O pesquisador forneceu um repositório GitHub para o KavachBench e um código de endosso do arXiv para facilitar o processo de submissão.