跳到正文
原文
arXiv cs.AI· Cris Huynh·· 4 小时前AI 评分38

鲁棒即显著:知情对手将最优信号移到显著性极点

Robust Is Salient: An Informed Adversary Moves the Optimal Signal onto the Salience Pole

AI 导读

在强迫选择任务中给知情对手加入说服预算 β 后,最优信号从后验最大选项转向边际最大选项;108 个确证条目上,对抗鲁棒最优点与显著性极点完全一致。200,000 条池中两者仅 2,748 条不同;两种对手框架让 7 个语言模型在 108 条中的 30 至 77 条改变选择。这一重合是结构性限制,评估无法据此区分模型趋向对抗感知最优还是显著性。

来源:arXiv cs.AI · arxiv.org