Un investigador independiente está solicitando un aval de autores establecidos en la comunidad de criptografía y seguridad para presentar un artículo titulado "KavachBench: Una Evaluación Empírica del Cumplimiento Determinista de Políticas Contra Inyección de Prompts Basada en Problemas en Agentes de Código IA" a arXiv.

El estudio evalúa Kavach, un tiempo de ejecución determinista basado en Rust para el cumplimiento de políticas en agentes de código IA, contra ataques de inyección de prompts de IssueTrojanBench. La evaluación encontró que las políticas predeterminadas bloquearon el 88% de las acciones maliciosas, y la cobertura refinada alcanzó el 100%, aunque los autores señalan que esto es específico del corpus y no una afirmación de generalización.

El investigador ha proporcionado un repositorio de GitHub para KavachBench y un código de aval de arXiv para facilitar el proceso de presentación.