跳到正文
原文
AGI Hunt· wunderwuzzi23·· 4 小时前AI 评分36

安全研究者 wunderwuzzi 重提「假设偏见」:AI 安全需要自己的 Assume Breach

红队老炮重提「假设偏见」:AI 安全需要自己的 Assume Breach

AI 导读

安全研究者 wunderwuzzi 重提自己 2020 年提出的「Assume Bias」理念,主张 AI 安全需要类似网络安全「assume breach」的「assume misalignment(假定不对齐)」框架。

来源:AGI Hunt · agihunt.info