O pesquisador independente de segurança de IA Krishnakaanth Reddy Yeduguru está solicitando um endosso para a categoria cs.CR no arXiv para um artigo intitulado "RedSOC — Um Framework de Avaliação Adversarial para Centros de Operações de Segurança Integrados com LLM."

O estudo apresenta descobertas-chave, incluindo uma taxa de sucesso do ataque (ASR) de 100% para injeção indireta de prompts e ASR de 80% para envenenamento do corpus. Além disso, a camada de detecção proposta alcançou 100% de detecção em 15 cenários e 10 execuções independentes sem exigir os internos do modelo.

O autor fornece um código de endosso (3RCVLY) para facilitar o processo de revisão no arXiv.