AGI Hunt· moniquejmorrow·· 4 小时前AI 评分37
Anthropic 安全研究者 Monique Morrow:Agent 最小权限须由架构强制执行
安全研究者呼吁Agent权限最小化应由架构强制执行
AI 导读
Anthropic 安全研究者 Monique Morrow 提出,如果 AI Agent 的任务能在已批准的沙箱环境内全部完成,就不应赋予其对外网络访问权限。她强调,提示词可以定义任务并塑造预期行为,但最小权限必须由周边架构强制执行,不能仅依赖提示词约束。
来源:AGI Hunt · agihunt.info