跳到正文
原文
arXiv cs.CV· Genpei Zhang·· 4 小时前AI 评分40

编码却未连通:在 patching null 下分解视觉语言模型的失败模式

Encoded but Disconnected: Decomposing Vision-Language Model Failures under a Patching Null

AI 导读

LLaVA-1.5-7B、Qwen2.5-VL-7B、InternVL3-8B 三个视觉语言模型在 POPE 上呈现同一负面结果:中层在 68-91% 的错误中已编码正确答案,但 residual-stream patching 在层级别造成 0% 非平凡翻转,该信号对最终预测无因果作用。

来源:arXiv cs.CV · arxiv.org