AGI Hunt· hunarbatra·· 6 小时前AI 评分21
研究者携推理模型潜空间策略状态(Latent Policy States)研究参加 COLM
研究者携「推理模型潜空间策略状态」解读工作参加 COLM
AI 导读
作者 hunarbatra 宣布将在本周的 COLM 会议上展示推理模型中潜空间策略状态(Latent Policy States)的研究。该研究方向涉及可操作的模型可解释性、AI control、reward hacking、meta models、安全后训练与评测,作者欢迎与会者交流相关话题。
来源:AGI Hunt · agihunt.info