AGI Hunt· burny_tech·· 5 小时前AI 评分42
Harness Learning 让 Agent 脚手架免改权重实现测试时自适应
AI 导读
卡内基梅隆等多机构研究者在 arXiv 发布 Harness Learning:不更新模型权重,而是用执行反馈训练模型修订 Agent 的 harness(脚手架),使其在测试时自适应进化。实验显示,该方法能让模型适应从未见过的任务,性能接近翻倍,为 Agent 的通用化适应提供了新思路。
来源:AGI Hunt · agihunt.info