AGI Hunt· m_wulfmeier·· 3 小时前AI 评分40
HuGo 方法用 LLM/VLM 自动生成并验证机器人策略,无需示范和奖励工程
HuGo 方法用 LLM/VLM 自动生成验证机器人策略,无需示范和奖励工程
AI 导读
HuGo 用 LLM 和 VLM 生成并验证机器人策略,不需要演示数据或奖励塑造,只需用语言定义新任务。其中 LLM/VLM 在高层生成指令,由 NVIDIA 的 SONIC 执行,底层由 RL 控制器完成。经过多轮 sim2real 与真实世界持续学习后数据效率显著,同一方法可开箱即用地迁移到真实世界适配新任务。
来源:AGI Hunt · agihunt.info