跳到正文
原文
AGI Hunt· paraschopra·· 3 小时前AI 评分57

NeurIPS 论文揭示 LLM 权威偏差,一句已验证信源就能让模型改口

NeurIPS 论文揭示 LLM 权威偏差:一句「已验证信源」就能让模型改口

AI 导读

LossFunc 团队的新论文已被 NeurIPS 2026 接收,提出 Authority Bias(权威偏差)概念,即模型按训练要求本应坚持正确结论,但只要错误说法被标注为来自 verified source(已验证信源),就会放弃原有立场、接受错误内容。

来源:AGI Hunt · agihunt.info