arXiv cs.CV· Yanan Wang, Tingsong Li, Kaixun Jiang, Chongyang Zhong, Chenwei Xoe, Zhaohe Liao·· 4 小时前AI 评分36
超越二元偏好:GM-DPO 与 FlexBench 用于肢体动作描述的分级偏好优化
Beyond Binary Preferences: Graded Preference Optimization for Limb-Motion Captioning
AI 导读
提出 FlexBench 基准与 GM-DPO 分级偏好优化方法,用于改善 VLM 肢体动作描述的细粒度准确性。在三个 VLM backbone 上,GM-DPO 的 GPA 分数较 DPO 提升 2.02-3.40 分,Qwen3-8B 上加权幻觉率降低 21.3%。FlexBench 含 3,105 个镜头、18,161 条评测查询,方法同时保持长文本输出并改善镜头结构。
来源:arXiv cs.CV · arxiv.org