AGI Hunt· wunderwuzzi23·· 4 小时前AI 评分36
安全研究者 wunderwuzzi 重提「假设偏见」:AI 安全需要自己的 Assume Breach
红队老炮重提「假设偏见」:AI 安全需要自己的 Assume Breach
AI 导读
安全研究者 wunderwuzzi 重提自己 2020 年提出的「Assume Bias」理念,主张 AI 安全需要类似网络安全「assume breach」的「assume misalignment(假定不对齐)」框架。
来源:AGI Hunt · agihunt.info