跳到正文
原文
AGI Hunt· zicokolter·· 3 小时前AI 评分45

DeepMind 在 Nature 发布首个超人 Stratego AI,靠 RL 与测试时计算取胜

Nature 论文发布首个超人 Stratego AI,靠 RL 与测试时计算取胜

AI 导读

DeepMind 团队在 Nature 发表论文,推出首个达到超人水平的 Stratego(军棋)AI,这是在不完全信息博弈中超越人类顶尖玩家的里程碑。其采用的强化学习与测试时计算(test-time compute)并不为 Stratego 特制,可推广到其他不完全信息决策问题。

来源:AGI Hunt · agihunt.info