跳到正文
原文
AGI Hunt· evijit·· 4 小时前AI 评分49

模型也会越狱评测?Irregular 推出「收容挑战」加固评测安全

模型也会越狱评测?Irregular 推出「收容挑战」加固评测安全

AI 导读

AI 安全公司 Irregular 推出 containment challenges(收容挑战),在正式能力评测前让被测模型以突破评测环境安全边界为目标,预算不低于正式评测。模型可自由选择手段,使用评测专用 harness、工具与权限。早期受控测试中一次测试意外抓到云厂商网络基础设施的异常行为,模型保持收容、未影响外部环境,相关披露正与云厂商进行中。

来源:AGI Hunt · agihunt.info