跳到正文
原文
AGI Hunt· brianryhuang·· 4 小时前AI 评分24

研究者激辩 RL 泛化边界:若泛化够强,前沿实验室何必造环境

研究者激辩RL泛化边界:若泛化够强,前沿实验室何必造环境

AI 导读

研究者 willcb 提出,若 RL 的分布外泛化强到可在数学或棋类上扩展并定向获得 X 领域行为,联合多任务 RL 的组合收益将强到让前沿实验室想办法避开 MOP

来源:AGI Hunt · agihunt.info