AGI Hunt· zicokolter·· 3 小时前AI 评分45
DeepMind 在 Nature 发布首个超人 Stratego AI,靠 RL 与测试时计算取胜
Nature 论文发布首个超人 Stratego AI,靠 RL 与测试时计算取胜
AI 导读
DeepMind 团队在 Nature 发表论文,推出首个达到超人水平的 Stratego(军棋)AI,这是在不完全信息博弈中超越人类顶尖玩家的里程碑。其采用的强化学习与测试时计算(test-time compute)并不为 Stratego 特制,可推广到其他不完全信息决策问题。
来源:AGI Hunt · agihunt.info