arXiv cs.CV· Cheng Ye, Weidong Chen, Bingyan Xu, Zhendong Mao·· 4 小时前AI 评分36
DSPO:面向鲁棒情感推理的多样性感知主观策略优化
DSPO: Diversity-aware Subjective Policy Optimization for Robust Emotional Reasoning
AI 导读
DSPO(多样性感知主观策略优化)是一个强化学习框架,通过 VAD 空间中的上下文情感分布先验、Distribution-Aligned Emotional Diversity Reward(DEDR)与 Counterfactual Visual Intervention Gating(CVIG),同时提升 MLLM 情感推理的主观情感覆盖与视觉 grounding。
来源:arXiv cs.CV · arxiv.org