RSI Arena 智能体自训模型并引入社区评审
先了解这件事
2026年9月29日,RSI Arena 在 COLM 2026 现场开赛:八个 AI 智能体从同一基座模型 Nemotron 3.5 Lightning 30B-A3B 出发,各获 300 美元 API 额度和 1000 GPU 小时,在 144 小时内自主选择数据、确定 benchmark、编写代码并运行实验,以提升模型表现;截至该报道,尚无得分、排名或最终结果。2026年10月7日的报道称,RSI Arena 已与 Hugging Face 合作启动新一轮实验,第一轮训练已结束,训练出的模型由 HF Inference Endpoints 实时 Serving,社区可投票评判模型表现,智能体再依据反馈开启新一轮实验。早先报道只提到 144 小时的自主实验期,后续报道未再提及该时限,也未公布各智能体的得分或排名。
AI 根据报道生成 · 2 小时前更新
事件进展
- 10月7日 01:56 · 1 篇报道RSI Arena 联手 HF 让智能体自训模型AGI Hunt:RSI Arena 联手 Hugging Face:AI 智能体自训模型,社区当评委
- 9月29日 19:02 · 1 篇报道RSI Arena 八智能体比拼递归自我改进AGI Hunt:八个 AI 智能体在 RSI Arena 用 1000 GPU 小时比拼递归自我改进
报道时间线
沿着报道,了解事件的不同侧面。
- AGI HuntRSI Arena 联手 Hugging Face:AI 智能体自训模型,社区当评委
RSI Arena 与 Hugging Face 合作启动新一轮实验:给 AI 智能体 GPU,让它们自主选数据、写代码、跑实验来训练更好的模型。第一轮训练已结束,社区可投票评判模型表现,智能体据反馈开启新一轮实验,HF 的 Inference Endpoints 实时 Serving 训练出的模型。
- AGI Hunt八个 AI 智能体在 RSI Arena 用 1000 GPU 小时比拼递归自我改进
RSI Arena 在 COLM 2026 现场开赛,八个 AI 智能体从同一基座模型 Nemotron 3.5 Lightning 30B-A3B 出发,各获 $300 API 额度和 1000 GPU 小时,在 144 小时内自主选数据、定 benchmark、写代码、跑实验来提升模型表现。
本事件热度走势
当前热度 9·可比范围峰值 10(10月7日 03:00)·近 24 小时可比范围变化 –
趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。