跳到正文
热点事件持续更新

AI 沙箱不预设模型善恶:信任不是安全原语

1 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

2026 年 9 月 30 日,AGI Hunt 发布文章讨论 AI 沙箱的设计理念。文章称,沙箱不对模型行为做任何预设:无论模型是善意、具有欺骗性、暗中谋划,还是具备情境感知能力,一律断网络、不给凭据、不给 shell、不持久化、不执行任意程序。作者由此提出,信任从来不是安全原语(trust is not a security primitive),并指出每一代工程师都曾以为边界多余,AI 时代也不豁免这条规律。该报道未给出具体产品或实现细节,仅陈述这一沙箱原则及其推论。

AI 根据报道生成 · 42 分钟前更新

报道时间线

沿着报道,了解事件的不同侧面。

9月30日
  1. AGI Hunt
    AI 沙箱不预设模型善恶:信任从来不是安全原语

    沙箱不对模型行为做任何预设,无论模型是善意、欺骗性、暗中谋划还是具备情境感知能力,都断网络、不给凭据、不给 shell、不持久化、不执行任意程序。作者据此指出,信任从来不是安全原语(trust is not a security primitive)——每一代工程师都曾以为边界多余,AI 时代也不豁免这条规律。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。