跳到正文
原文
AGI Hunt· maxhkw·· 3 小时前AI 评分47

新论文:LLM 集群学不会「社会性自我改进」,模仿同伴反伤探索

新论文:LLM 集群学不会「社会性自我改进」,模仿同伴反伤探索

AI 导读

Max Kleiman-Weiner 等人发布论文,提出「递归社会性改进」概念,测试三个 LLM 能否在追求各自奖励时通过互相学习提升整体水平。受控环境中三个被测 LLM 单位 token 收益均低于独立学习者,让模型自行编写修订 skills 后也未在同等成本下胜出。技能虽被复制、修订、传递,但交流使群体集中在更少的独立发现上。

来源:AGI Hunt · agihunt.info