跳到正文
原文
AGI Hunt· my_cat_can_code·· 4 小时前AI 评分36

RSI Arena 直播实验:让 AI 智能体自己训练更强 AI

AI 导读

RSI Arena 正在直播「递归自我改进」实验,给 AI 智能体分配 GPU 和预算(API 费用加 GPU 时间),让它们自主训练一个能在人类评估中胜出的模型。有博主跟进这场竞技场后显示,Gemini 3.8 flash 大约训练了 12 小时后主动喊停,由此引发社区对 AI 自我改进能力的关注与讨论。

来源:AGI Hunt · agihunt.info