arXiv cs.CV· Ruochen Zhang, Yao Huang, Yitong Sun, Jiahe Xie, Jin Yan, Jifan Ma, Yuanfang Guo, Xingxing Wei·· 4 小时前AI 评分41
ThinkingGuard:通过逐步风险归因解码多模态大语言模型中的隐式风险
ThinkingGuard: Decoding Implicit Hazards via Step-by-Step Risk Attribution in Multimodal Large Language Models
AI 导读
ThinkingGuard 通过逐步风险归因解码多模态大语言模型中的隐式风险,在标准与隐式安全 benchmark 上取得强表现。
来源:arXiv cs.CV · arxiv.org