热点事件持续更新
人类与VLM跨模态关联:选择相似注意力不同
1 篇报道1 个报道来源4 小时前更新
先了解这件事
AI 综述
2026年9月30日,arXiv cs.CL 发布一项研究,用相同刺激对比人类与视觉语言模型(VLM)的跨模态关联。结果显示,部分较大的 VLM 在跨模态关联选择上与人类一致,但就显著性而言,其与人类注视的吻合度低于 center-bias 基线。研究还尝试用人类选择微调小型 VLM,微调后该模型对未见词和图像的选择对齐达到人类多数投票参考水平,不过注意力仍不如 center-bias 基线贴近人类注视。此外,用人类注视训练注意力只提升注意力与注视的相关性,并不改善选择对齐。
AI 根据报道生成 · 3 小时前更新
最新进展9月30日 12:00
研究显示较大VLM跨模态选择与人类一致,但注意力吻合度不及center-bias基线。报道时间线
沿着报道,了解事件的不同侧面。
9月30日
- arXiv cs.CL人类与视觉语言模型(VLM)的跨模态关联:选择相似,注意力不同
研究用相同刺激对比人类与 VLM 的跨模态关联,部分较大 VLM 选择与人类一致,但显著性与人类注视的吻合度低于 center-bias 基线。用人类选择微调小型 VLM,可让其对未见词和图像的选择对齐达到人类多数投票参考水平,注意力仍不如该基线贴近人类注视。用人类注视训练注意力只提升注意力-注视相关性,不改善选择对齐。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。