AGI Hunt· paraschopra·· 3 小时前AI 评分57
NeurIPS 论文揭示 LLM 权威偏差,一句已验证信源就能让模型改口
NeurIPS 论文揭示 LLM 权威偏差:一句「已验证信源」就能让模型改口
AI 导读
LossFunc 团队的新论文已被 NeurIPS 2026 接收,提出 Authority Bias(权威偏差)概念,即模型按训练要求本应坚持正确结论,但只要错误说法被标注为来自 verified source(已验证信源),就会放弃原有立场、接受错误内容。
来源:AGI Hunt · agihunt.info