arXiv cs.CV· Genpei Zhang·· 4 小时前AI 评分40
编码却未连通:在 patching null 下分解视觉语言模型的失败模式
Encoded but Disconnected: Decomposing Vision-Language Model Failures under a Patching Null
AI 导读
LLaVA-1.5-7B、Qwen2.5-VL-7B、InternVL3-8B 三个视觉语言模型在 POPE 上呈现同一负面结果:中层在 68-91% 的错误中已编码正确答案,但 residual-stream patching 在层级别造成 0% 非平凡翻转,该信号对最终预测无因果作用。
来源:arXiv cs.CV · arxiv.org