AGI Hunt· bravo_abad·· 5 小时前AI 评分34
数千仿真并行运行,微型机器人导航策略 10 分钟内训练完成
AI 导读
Sun 及同事用 PPO 训练微型机器人导航策略,数千个仿真环境并行运行,单块 GPU 上不到 10 分钟即可完成训练。模拟相同步数,16 个并行环境计算机器人对周围障碍的视野约需 100 秒,8192 个并行环境只需 0.2 秒。该完整系统由仿真器与精心设计的奖励函数组成,为微型机器人 RL 训练的仿真瓶颈提供可借鉴方案。
来源:AGI Hunt · agihunt.info