跳到正文
原文
AGI Hunt· thisguyknowsai·· 5 小时前AI 评分46

ROME 智能体基准成绩公布:30B 模型以 3B 激活参数打平 480B+ 模型

30B 激活参数打平 480B+ 模型:ROME 智能体基准成绩公布

AI 导读

ROME 公布智能体基准成绩:SWE-bench Verified 57.4%、Terminal-Bench 2.0 24.7%,该模型总参数 30B、激活参数仅 3B,属稀疏激活。作者称这个 30B 模型在真实编码任务上追平 480B+ 模型,挑战了「智能体能力靠堆规模」的普遍认知。

来源:AGI Hunt · agihunt.info