O autor desenvolveu o Epistemic Shield, um framework experimental que trata a resposta inicial de um LLM como uma hipótese provisória em vez de saída final. O sistema decompõe as respostas em afirmações atômicas e as submete a autocrítica adversarial para medir a consistência através de avaliações estocásticas.
- Decompõe respostas em afirmações atômicas para análise granular.
- Submete cada afirmação à autocrítica adversarial.
- Mede a consistência em múltiplas avaliações estocásticas.
- Incorpora evidência externa quando disponível.
- Aplica penalidades assimétricas a afirmações não suportadas em domínios de alto risco.
- Permite abstenção parcial em vez de forçar o modelo a responder tudo.
O autor está buscando críticas técnicas, sugestões de benchmarks e colaboradores para testar se esta arquitetura melhora a calibração ou a resistência a alucinações.