跳到正文
原文
AGI Hunt· hunarbatra·· 6 小时前AI 评分21

研究者携推理模型潜空间策略状态(Latent Policy States)研究参加 COLM

研究者携「推理模型潜空间策略状态」解读工作参加 COLM

AI 导读

作者 hunarbatra 宣布将在本周的 COLM 会议上展示推理模型中潜空间策略状态(Latent Policy States)的研究。该研究方向涉及可操作的模型可解释性、AI control、reward hacking、meta models、安全后训练与评测,作者欢迎与会者交流相关话题。

来源:AGI Hunt · agihunt.info