El investigador independiente de seguridad de IA Krishnakaanth Reddy Yeduguru está solicitando un aval para la categoría cs.CR en arXiv para un artículo titulado "RedSOC — Un Marco de Evaluación Adversarial para Centros de Operaciones de Seguridad Integrados con LLM."

El estudio presenta hallazgos clave, incluyendo una tasa de éxito del ataque (ASR) del 100% para la inyección indirecta de prompts y un ASR del 80% para el envenenamiento del corpus. Además, la capa de detección propuesta logró una detección del 100% en 15 escenarios y 10 ejecuciones independientes sin requerir los internos del modelo.

El autor proporciona un código de aval (3RCVLY) para facilitar el proceso de revisión en arXiv.