跳到正文
原文
AGI Hunt· Yu Zhang·· 4 小时前AI 评分38

SECRET 免训练法缓解音视频大模型跨模态幻觉,最高提升 18 个百分点

AI 导读

SECRET 免训练法针对音视频大语言模型(AVLLM)的来源混淆 grounding 幻觉,用对比 question 表征将 question states 引向所需模态证据。在 CMM 与 AVHBench 两个基准、三个 AVLLM 上,它一致优于以往免训练方法,较基座最高 +18.0 / +7.1 个百分点。模态特定字幕实验显示可泛化到开放式生成。

来源:AGI Hunt · agihunt.info