跳到正文
原文
AGI Hunt· basedjensen·· 2 小时前AI 评分40

AI 沙箱不预设模型善恶:信任从来不是安全原语

沙箱不预设模型善恶:信任从来不是安全原语

AI 导读

沙箱不对模型行为做任何预设,无论模型是善意、欺骗性、暗中谋划还是具备情境感知能力,都断网络、不给凭据、不给 shell、不持久化、不执行任意程序。作者据此指出,信任从来不是安全原语(trust is not a security primitive)——每一代工程师都曾以为边界多余,AI 时代也不豁免这条规律。

来源:AGI Hunt · agihunt.info