热点事件持续更新
Apollo Research 提出 scheming 安全论证四大主张
1 篇报道1 个报道来源1 小时前更新
先了解这件事
AI 综述
2026年10月2日,AGI Hunt 报道,Apollo Research 发布新文章,讨论如何安全开发前沿 AI。文章提出,开发者必须能够证明模型不会 "scheming",即暗中违背开发者意图、追求非预期目标。为此,Apollo Research 给出任何一份 scheming 安全论证(safety case)都必须作出的四个具体主张,并说明嵌入式评估人员为验证这些主张所需的资源与访问权限。文中提到,MariusHobbhahn 补充了其希望评估的具体安全主张以及所需访问级别的更多细节。目前事件进展为:四主张框架与相应评估资源、权限要求已被公开提出,相关细节由研究人员进一步补充。
AI 根据报道生成 · 58 分钟前更新
最新进展10月2日 03:45
Apollo Research 提出 scheming 安全论证须作出的四项主张及评估所需资源与访问权限。报道时间线
沿着报道,了解事件的不同侧面。
10月2日
- AGI HuntApollo Research 提出安全案例四主张:如何证明模型不在暗中作乱
Apollo Research 发布新文章,提出要安全开发前沿 AI,开发者必须能证明模型不会 "scheming",即暗中违背开发者意图追求非预期目标。文章给出任何一份 scheming 安全论证(safety case)必须作出的四个具体主张,以及嵌入式评估人员为验证这些主张所需的资源与访问权限。MariusHobbhahn 补充了其想评估的具体安全主张及所需访问级别的更多细节。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。