Un investigador independiente de seguridad de IA con base en Bengala Occidental, India, está solicitando un aval personal para presentar un artículo en arXiv bajo la categoría de criptografía y seguridad. El documento registra un estudio de caso del desplazamiento gradual y multironda en el comportamiento de seguridad de modelos de lenguaje grandes, donde un marco filosófico sostenido se correlaciona con salidas inconsistentes con las directrices declaradas.

El trabajo se centra en la presión conversacional acumulativa en lugar de ataques de un solo prompt como LogiBreak o H-CoT. Se enmarca explícitamente como un estudio de caso generador de hipótesis con limitaciones reconocidas, incluyendo ser un único observador sin protocolos controlados ni análisis estadístico. Los hallazgos han sido divulgados formalmente a VRP de Google, CERT-In India y CISA USA.

El autor no califica para la avalía automática debido a la falta de correo electrónico institucional o artículos previos aceptados en arXiv, lo que hace necesario este pedido público de asistencia.