AGI Hunt· dejavucoder·· 4 小时前AI 评分39
PostTrainBench v1.2 发布:Fable 5.1 以 44.6% 登顶,Claude Opus 5.5 居次
PostTrainBench v1.2 发布:Fable 5.1 以 44.6% 登顶,Opus 5.5 居次
AI 导读
PostTrainBench v1.2 更新发布,Fable 5.1 以 44.6% 成为排名第一的 agent,Claude Opus 5.5 位居第二。该 benchmark 现已支持通过 Harbor 框架自行复现运行。
来源:AGI Hunt · agihunt.info