跳到正文
原文
AGI Hunt· sarahwiegreffe·· 2 小时前AI 评分44

COLM 论文:潜空间推理模型的潜 token 多数可解码,可解释性即正确性信号

COLM 论文:潜空间推理模型的潜 token 多数可解码,可解释性即正确性信号

AI 导读

Sarah Wiegreffe 团队在 COLM 发表 LRM 可解释性研究:当潜 token 对性能必要时,两个最先进潜空间推理模型有 65–93% 的正确预测可解码出标准推理轨迹。研究还发现逻辑推理数据集上不用潜推理也能得到几乎相同的最终答案,并据此质疑潜 token 的作用。作者另提出无需金标即可从潜 token 解码经验证自然语言推理轨迹的方法,能否解码出可验证轨迹本身即正确性信号。

来源:AGI Hunt · agihunt.info