跳到正文
原文
arXiv 自然语言处理· Chufan Shi, Cheng Yang, Tiannuo Yang, Isadora White, Yiwei Chen, Taylor Berg-Kirkpatrick, Xuezhe Ma·· 5 小时前AI 评分47

统一多模态模型中的视觉拒答机制研究

Visual Abstention in Unified Multimodal Models

AI 导读

该研究形式化了统一多模态模型识别并拒绝不可行编辑的“视觉拒答”能力,并推出含 1,050 对样本的 DoD 评测基准。评测发现 8 款主流模型极少主动拒答(最强模型拒答率仅 0.4%),且提示词干预会损害编辑准确率。基于新训练方法 VisTA 构建的 VisTA-BAGEL 实现了 93.0% 的拒答率,同时可行编辑准确率达到 74.3%。

来源:arXiv 自然语言处理 · arxiv.org