跳到正文
热点事件持续更新

安全算子:以谱优化调节安全指令表达强度

1 篇报道1 个报道来源4 小时前更新

先了解这件事

AI 综述

2026年9月30日,arXiv cs.AI 上的一篇研究提出“安全算子”这一概念。研究者把 Transformer 语言模型中上下文 token 被吸收进权重后形成的乘法算子称为“安全算子”,并指出该算子的主导特征值可以像连续旋钮一样,调节安全指令对模型生成的影响强度。也就是说,安全指令在生成过程中的作用强弱,被刻画为该算子主导特征值的大小,从而具备连续可调的性质。目前该事件仅见这一篇报道,尚未有后续进展、复现结果或第三方验证信息。

AI 根据报道生成 · 3 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

9月30日
  1. arXiv cs.AI
    安全算子:通过谱优化调节安全指令的表达

    研究者把 Transformer 语言模型中上下文 token 吸收进权重形成的乘法算子称为“安全算子”,其主导特征值可像连续旋钮一样调节安全指令对生成的影响强度。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。