AGI Hunt· antoine_chaffin·· 4 小时前AI 评分27
Decider 模型作者回应刷榜质疑:公开私榜差距极小
AI 导读
Decider 模型作者 antoinechaffin 回应 benchmaxxing 刷榜质疑,称近期分数提升源于解除 causal mask 去因果限制、扩充训练数据等合理改进。该模型在新榜单上保持第一,且公开榜与私榜(private split)差距极小,作者据此证明成绩真实且具备泛化能力,并非刷榜。
来源:AGI Hunt · agihunt.info