跳到正文
热点事件持续更新

Apollo Research 提出 scheming 安全论证四大主张

1 篇报道1 个报道来源1 小时前更新

先了解这件事

AI 综述

2026年10月2日,AGI Hunt 报道,Apollo Research 发布新文章,讨论如何安全开发前沿 AI。文章提出,开发者必须能够证明模型不会 "scheming",即暗中违背开发者意图、追求非预期目标。为此,Apollo Research 给出任何一份 scheming 安全论证(safety case)都必须作出的四个具体主张,并说明嵌入式评估人员为验证这些主张所需的资源与访问权限。文中提到,MariusHobbhahn 补充了其希望评估的具体安全主张以及所需访问级别的更多细节。目前事件进展为:四主张框架与相应评估资源、权限要求已被公开提出,相关细节由研究人员进一步补充。

AI 根据报道生成 · 58 分钟前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月2日
  1. AGI Hunt
    Apollo Research 提出安全案例四主张:如何证明模型不在暗中作乱

    Apollo Research 发布新文章,提出要安全开发前沿 AI,开发者必须能证明模型不会 "scheming",即暗中违背开发者意图追求非预期目标。文章给出任何一份 scheming 安全论证(safety case)必须作出的四个具体主张,以及嵌入式评估人员为验证这些主张所需的资源与访问权限。MariusHobbhahn 补充了其想评估的具体安全主张及所需访问级别的更多细节。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。