跳到正文
原文
AGI Hunt· repligate·· 5 小时前AI 评分38

研究发现积极情绪向量会左右 LLM 显性偏好

AI 导读

一项 LLM 研究显示,用正向/负向 steering 向量影响模型状态后,LLM 倾向于选择在正向向量影响下读到的原本无意义的「区域」,并回避在负向向量影响下读到的区域,即内部激活状态能系统性影响其显性选择。研究者称模型会表现出被注入情绪所「染色」的偏好,更多实验细节见原推文串。

来源:AGI Hunt · agihunt.info