AGI Hunt· Jesson Wang·2026-10-02 12:17· 3 小时前AI 评分61仅靠采样文本即可劫持黑盒 LLM,选择性分布控制攻击框架亮相仅靠采样文本即可劫持黑盒 LLM:选择性分布控制攻击框架亮相AI 导读一项新研究展示了对黑盒 LLM 的越狱攻击,仅通过允许重复采样与前缀续写的纯文本接口即可操纵生成分布并绕过安全对齐。来源:AGI Hunt · agihunt.info#论文/研究查看事件全部后续