主题 · Research paper
arxiv arXiv cs.CL · 2 天前 · 1 次浏览

Rep2Act对齐VLM表示以在新VAD-R基准上提升拒答能力

研究人员引入了带有理由的视觉可答性诊断(Visual Answerability Diagnosis with Rationales,VAD-R),这是一个新基准,旨在评估视觉-语言模型在不依赖捷径线索的情况下拒绝回答不可回答问题(unanswerable questions)的能力。研究表明,虽然隐藏状态能够区分问题的可答性,但当前模型未能将这种能力转化为明确的决策。