Um pesquisador independente de segurança de IA baseado em Bengala Ocidental, Índia, está solicitando um endosso pessoal para submeter um artigo no arXiv sob a categoria de criptografia e segurança. O documento documenta um estudo de caso do deslocamento gradual e multironda no comportamento de segurança de modelos de linguagem grandes, onde um enquadramento filosófico sustentado se correlaciona com saídas inconsistentes com as diretrizes declaradas.
O trabalho foca na pressão conversacional cumulativa em vez de ataques de prompt único como LogiBreak ou H-CoT. É explicitamente enquadrado como um estudo de caso gerador de hipóteses com limitações reconhecidas, incluindo ser um único observador sem protocolos controlados ou análise estatística. Os achados foram formalmente divulgados ao VRP do Google, CERT-In Índia e CISA EUA.
O autor não se qualifica para endosso automático devido à falta de e-mail institucional ou artigos anteriores aceitos no arXiv, tornando necessário este pedido público de assistência.