跳到正文
原文
arXiv cs.CV· Ruochen Zhang, Yao Huang, Yitong Sun, Jiahe Xie, Jin Yan, Jifan Ma, Yuanfang Guo, Xingxing Wei·· 4 小时前AI 评分41

ThinkingGuard:通过逐步风险归因解码多模态大语言模型中的隐式风险

ThinkingGuard: Decoding Implicit Hazards via Step-by-Step Risk Attribution in Multimodal Large Language Models

AI 导读

ThinkingGuard 通过逐步风险归因解码多模态大语言模型中的隐式风险,在标准与隐式安全 benchmark 上取得强表现。

来源:arXiv cs.CV · arxiv.org