跳到正文
原文
arXiv cs.CL· Chufan Shi, Cheng Yang, Tiannuo Yang, Isadora White, Yiwei Chen, Taylor Berg-Kirkpatrick, Xuezhe Ma·· 4 小时前AI 评分45

统一多模态模型的视觉拒答:Draw-or-Decline 基准与 VisTA 训练方法

Visual Abstention in Unified Multimodal Models

AI 导读

论文提出 Draw-or-Decline(DoD)基准,用 7 类任务、1,050 组可行/不可行请求对评估 8 个统一多模态模型,发现最强编辑器编辑准确率 68.4%,却只拒绝 0.4% 的不可行请求。VisTA 方法训练出的 VisTA-BAGEL 无需提醒即拒绝 93.0% 不可行请求,误拒 0.8% 可行请求,并完成 74.3% 可行编辑。

来源:arXiv cs.CL · arxiv.org