跳到正文
热点事件持续更新

JevBench v1.6.0 重测92模型,Quyet登顶

1 篇报道1 个报道来源8 小时前更新

先了解这件事

AI 综述

2026 年 10 月 5 日,AGI Hunt 报道称 JevBench 发布 v1.6.0,在全新密封测试集上重测全部 92 个 Jev 级模型。能力榜榜首随之换血:Quyet-1.0-Large 以 81.7 分登顶,超过 deck-31B 的 77 分。新版还新增 22 种语言的细分打分,其中德语项目上 deck-31B 得 97 分、Quyet 得 94 分,31B 级模型表现坚挺;与此同时,若干 4B 小模型的多语种能力出现崩塌。报道未披露其余模型的具体分数与完整排名。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月5日
  1. AGI Hunt
    JevBench v1.6.0 重测 92 个模型,榜首换血并新增 22 语言细分

    JevBench 发布 v1.6.0,在全新密封测试集上重测全部 92 个 Jev 级模型,Quyet-1.0-Large 以 81.7 分登顶能力榜,超过 deck-31B 的 77 分。新版新增 22 种语言细分打分,deck-31B 德语 97 分、Quyet 94 分,31B 级模型表现坚挺,而若干 4B 小模型的多语种能力出现崩塌。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。