Un chercheur indépendant a publié KavachBench, un benchmark évaluant la barrière de sécurité de l'agent de codage IA Kavach contre le corpus d'IssueTrojanBench de 42 actions d'appel d'outil malveillantes dérivées des payloads d'issues GitHub.

  • L'évaluation a utilisé le corpus réel d'injection de prompt d'IssueTrojanBench contenant 42 actions d'attaque sur 4 catégories.
  • Les résultats ont démontré que la couverture est obtenue par la canonisation de l'adaptateur sous une politique de refus par défaut, plutôt que par un ajustement spécifique au benchmark.
  • Le harnais de recherche et l'article sont disponibles sur Zenodo et GitHub pour examen ultérieur.

Les conclusions soulignent l'importance de distinguer entre l'application basée sur la canonisation et l'ajustement spécifique lors de l'évaluation de barrières de sécurité similaires.