跳到正文
原文
AGI Hunt· ChengleiSi·· 8 小时前AI 评分29

NLP 研究者 AdithyaNLP 自荐博士最重要论文:让语言模型用自然语言版 AlphaZero 学下棋并解释

作者自评博士最重要论文:让语言模型用自然语言版 AlphaZero 学下棋并解释

AI 导读

NLP 研究者 AdithyaNLP 自荐其博士期间最深刻的论文:让语言模型(LM)学会下国际象棋并给出走法解释。方法上结合架构与算法双重创新,核心是把 AlphaZero 算法做“自然语言类比”,使 LM 能在语言空间中自我对弈学习。作者声称该框架可推广到棋类之外的许多领域。

来源:AGI Hunt · agihunt.info