跳到正文
原文
AGI Hunt· Mingyu Liu·· 5 小时前AI 评分44

PerturBot 用扰动训练打破视觉-语言-动作模型的捷径依赖

AI 导读

佐治亚理工团队提出 PerturBot,用三种方式让视觉-语言-动作(VLA)策略的「模态捷径」失效:在腕部视角施加不改变任务的扰动、用决策相关字幕增强指令、混入随机与失败轨迹段并重新标注其行为。其推理流程不变,可与规模化训练互补。团队同时提出离线诊断指标 GroundingFscore,用于衡量策略对捷径的依赖程度,判断策略扩展是否真正依赖任务证据。

来源:AGI Hunt · agihunt.info