Независимый исследователь запрашивает рекомендацию от известных авторов в сообществе криптографии и безопасности для подачи статьи с названием «KavachBench: Эмпирическая оценка детерминированного обеспечения политики против инъекций на основе проблем в AI-агентах по написанию кода» на arXiv.

Исследование оценивает Kavach, основанный на Rust детерминированный механизм обеспечения политик для AI-агентов по написанию кода, против атак с инъекциями промптов из IssueTrojanBench. Оценка показала, что политики «из коробки» блокировали 88% вредоносных действий, а уточненное покрытие достигло 100%, хотя авторы отмечают, что это специфично для данного корпуса данных, а не утверждение об обобщении.

Исследователь предоставил репозиторий GitHub для KavachBench и код рекомендации arXiv для упрощения процесса подачи.