热点事件持续更新
JevBench v1.6.0 重测92模型,Quyet登顶
1 篇报道1 个报道来源8 小时前更新
先了解这件事
AI 综述
2026 年 10 月 5 日,AGI Hunt 报道称 JevBench 发布 v1.6.0,在全新密封测试集上重测全部 92 个 Jev 级模型。能力榜榜首随之换血:Quyet-1.0-Large 以 81.7 分登顶,超过 deck-31B 的 77 分。新版还新增 22 种语言的细分打分,其中德语项目上 deck-31B 得 97 分、Quyet 得 94 分,31B 级模型表现坚挺;与此同时,若干 4B 小模型的多语种能力出现崩塌。报道未披露其余模型的具体分数与完整排名。
AI 根据报道生成 · 1 小时前更新
最新进展10月5日 23:10
JevBench v1.6.0 用新密封测试集重测,Quyet-1.0-Large 以 81.7 分登顶。报道时间线
沿着报道,了解事件的不同侧面。
10月5日
- AGI HuntJevBench v1.6.0 重测 92 个模型,榜首换血并新增 22 语言细分
JevBench 发布 v1.6.0,在全新密封测试集上重测全部 92 个 Jev 级模型,Quyet-1.0-Large 以 81.7 分登顶能力榜,超过 deck-31B 的 77 分。新版新增 22 种语言细分打分,deck-31B 德语 97 分、Quyet 94 分,31B 级模型表现坚挺,而若干 4B 小模型的多语种能力出现崩塌。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。