Un chercheur indépendant en sécurité de l'IA basé au Bengale-Occidental, en Inde, demande un parrainage personnel pour soumettre un article sur arXiv dans la catégorie cryptographie et sécurité. L'article documente une étude de cas de dérive conversationnelle progressive et multironde dans le comportement de sécurité des grands modèles de langage, où un cadrage philosophique soutenu est corrélé à des sorties incohérentes avec les directives déclarées.
Le travail se concentre sur la pression conversationnelle cumulative plutôt que sur des attaques par prompt unique comme LogiBreak ou H-CoT. Il est explicitement présenté comme une étude de cas génératrice d'hypothèses avec des limites reconnues, notamment le fait d'être un observateur unique sans protocoles contrôlés ni analyse statistique. Les résultats ont été formellement divulgués au VRP de Google, à CERT-In Inde et à CISA USA.
L'auteur n'est pas éligible au parrainage automatique en raison de l'absence d'e-mail institutionnel ou d'articles précédemment acceptés sur arXiv, ce qui rend nécessaire cette demande publique d'assistance.