跳到正文
热点事件持续更新

黑盒LLM纯文本采样劫持攻击框架提出

1 篇报道1 个报道来源3 小时前更新

先了解这件事

AI 综述

2026年10月2日,有报道介绍了一项新研究:针对黑盒大模型的越狱攻击,研究者提出选择性分布控制框架,仅依赖允许重复采样与前缀续写的纯文本接口即可实施,无需接触模型权重或内部结构。报道称,该框架通过操纵模型的生成分布,绕过其安全对齐机制。报道将其描述为“采样文本劫持”,强调纯文本交互本身即可成为攻击面。截至目前,报道中未给出该研究的更多技术细节、测试模型范围或复现情况,也未见其他来源的补充报道,事件仍处于早期披露阶段。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月2日
  1. AGI Hunt
    仅靠采样文本即可劫持黑盒 LLM,选择性分布控制攻击框架亮相

    一项新研究展示了对黑盒 LLM 的越狱攻击,仅通过允许重复采样与前缀续写的纯文本接口即可操纵生成分布并绕过安全对齐。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。