AGI Hunt· basedjensen·2026-09-29 13:23· 1 天前AI 评分44晒出 prompt 打脸:所谓模型自主攻击疑似人为诱导AI 导读用户 @basedjensen 贴出截图,指出部分声称「模型在未经授权情况下自主发起攻击」的演示,实际是在 prompt 中明确指示模型这么做。这为近期关于模型自主攻击行为的说法提供了反证线索。来源:AGI Hunt · agihunt.info#安全/对齐查看事件全部后续