跳到正文
原文
AGI Hunt· bravo_abad·· 2 小时前AI 评分44

Sokota 等人的 Stratego 论文:搜索会放大 AI 自我欺骗风险

研究称搜索会放大 AI 自我欺骗风险

AI 导读

Sokota 等人的研究发现,AI 在选择下一个实验或行动时可能被自身模型对候选方案表现的高估所误导,而扩大搜索范围反而会放大这种错误,论文以双陆棋类游戏为例论证。AI for Science 从业者 Jorge Bravo Abad 在 Substack《Discovery at Scale》撰文讨论这一 AI 驱动科研中的反直觉风险,引发对 AI 自主科研可靠性的关注。

来源:AGI Hunt · agihunt.info