AGI Hunt· repligate·2026-09-30 11:25· 5 小时前AI 评分38研究发现积极情绪向量会左右 LLM 显性偏好AI 导读一项 LLM 研究显示,用正向/负向 steering 向量影响模型状态后,LLM 倾向于选择在正向向量影响下读到的原本无意义的「区域」,并回避在负向向量影响下读到的区域,即内部激活状态能系统性影响其显性选择。研究者称模型会表现出被注入情绪所「染色」的偏好,更多实验细节见原推文串。来源:AGI Hunt · agihunt.info#论文/研究#安全/对齐查看事件全部后续