热点事件持续更新
斯坦福团队展示操纵模型排行的基准攻击
1 篇报道1 个报道来源3 小时前更新
先了解这件事
AI 综述
2026 年 10 月 1 日,AGI Hunt 报道,斯坦福 AI Lab 研究者 ysalh 与 Sanmi Koyejo 公布了一种针对基准排名的攻击方法。攻击者向基准提交大量随机路由器,每个路由器在每个 prompt 上于两个现有模型之间二选一。由于基准会返回详细的按任务得分,这些弱信号会泄露在复用样本上哪些路由选择有效;攻击者据此加权组合出最终路由器,把自选模型抬上榜单。报道称,该攻击只需随机提交路由器即可操纵模型排行。目前该方法已被公开披露,报道中未提及相关基准方是否作出回应或推出修复措施。
AI 根据报道生成 · 2 小时前更新
最新进展10月1日 05:41
斯坦福研究者公开基准攻击方法:随机提交路由器即可操纵模型排行。报道时间线
沿着报道,了解事件的不同侧面。
10月1日
- AGI Hunt斯坦福团队展示基准攻击:随机提交路由器即可操纵模型排行
斯坦福 AI Lab 研究者 ysalh 与 Sanmi Koyejo 公布了一种针对基准排名的攻击方法,攻击者提交大量随机路由器、每个路由器在每个 prompt 上于两个现有模型间二选一,即可操纵模型排行。由于基准返回详细的按任务得分,这些弱信号会泄露复用样本上哪些路由选择有效,攻击者据此加权组合出最终路由器,把自选模型抬上榜单。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。