跳到正文
原文
AGI Hunt· rickasaurus·· 3 小时前AI 评分26

既然能向 LLM 注入痛苦向量,能否同样注入快乐向量?

既然能往模型里注入痛苦向量,能否同样注入快乐?

AI 导读

rickasaurus 提出一个开放性问题:既然通过操纵表示空间的向量就能让 LLM「感受痛苦」,按同样逻辑是否也能让它「感到愉悦」。这触及 AI 体验/福祉与价值对齐的争议核心——模型内部状态是否真的对应主观体验,以及干预这些方向意味着什么。

来源:AGI Hunt · agihunt.info