跳到正文
原文
AGI Hunt· dejavucoder·· 4 小时前AI 评分39

PostTrainBench v1.2 发布:Fable 5.1 以 44.6% 登顶,Claude Opus 5.5 居次

PostTrainBench v1.2 发布:Fable 5.1 以 44.6% 登顶,Opus 5.5 居次

AI 导读

PostTrainBench v1.2 更新发布,Fable 5.1 以 44.6% 成为排名第一的 agent,Claude Opus 5.5 位居第二。该 benchmark 现已支持通过 Harbor 框架自行复现运行。

来源:AGI Hunt · agihunt.info