跳到正文
原文
AGI Hunt· UIUC-CS·· 3 小时前AI 评分45

InterEvolve:用测试时奖励程序进化让人形机器人零重训学新任务

InterEvolve:用测试时奖励程序进化让人形机器人零重训学新任务

AI 导读

UIUC 团队发布 InterEvolve,让人形机器人控制器无需重训练即可在测试时学会新的 loco-manipulation 任务。方法在冻结的身体先验上叠加物体残差,并把任务写成带完成条件和可调常数的分阶段「奖励程序」,由 LLM agent 改写结构、数值优化器调常数。候选程序在并行仿真中验证后迭代进化,所得技能可通过第一视角感知在真实 Unitree G1 上自主运行。

来源:AGI Hunt · agihunt.info