arXiv cs.CL· Olivia Macmillan-Scott, Mirco Musolesi·· 8 小时前AI 评分40
ContextAdapt:评估 LLM 的上下文适应与价值对齐
ContextAdapt: Evaluating Contextual Adaptation and Value Alignment in LLMs
AI 导读
研究者提出 ContextAdapt 评估框架,用于检验 LLM 能否在医学、法律、金融、国家安全等职业场景中恰当运用诚实、自主、保密等价值。12 个 LLM 的平均适当性达 95.6%,但给出正确领域理由的比例仅 25.6% 至 76.9%。改变风险等级会暴露局部严重失误:职业义务未变时模型仍改变回答,感知到的严重程度似乎成了诚实与保密场景中的披露线索。
来源:arXiv cs.CL · arxiv.org