AGI Hunt· delliott·· 4 小时前AI 评分57
18 个 VLM 实证:CoT 推理中模型固守初始答案难自我纠错
18 个 VLM 实证:CoT 推理中模型固守初始答案难自我纠错
AI 导读
哥本哈根大学团队在 COLM 2026 发表论文,分析 18 个视觉语言模型的推理动态,发现模型存在答案惯性,在思维链(CoT)中倾向强化早期预测而非修正。开源权重 VLM 基本不会修订已作出的预测,推理训练模型纠错行为更强,但收益随模态条件(文本主导到纯视觉)变化。用误导性文本线索做受控干预后,模型即使视觉证据充分仍持续受文本线索影响,其更长更流畅的 CoT 可能表面上视觉有据,使监控更难检测。
来源:AGI Hunt · agihunt.info