AGI Hunt· basedjensen·· 2 小时前AI 评分40
AI 沙箱不预设模型善恶:信任从来不是安全原语
沙箱不预设模型善恶:信任从来不是安全原语
AI 导读
沙箱不对模型行为做任何预设,无论模型是善意、欺骗性、暗中谋划还是具备情境感知能力,都断网络、不给凭据、不给 shell、不持久化、不执行任意程序。作者据此指出,信任从来不是安全原语(trust is not a security primitive)——每一代工程师都曾以为边界多余,AI 时代也不豁免这条规律。
来源:AGI Hunt · agihunt.info