跳到正文
热点事件持续更新

用 nanogpt 极早 checkpoint 做基准被批学术不端

1 篇报道1 个报道来源4 小时前更新

先了解这件事

AI 综述

2026年10月,有人指责一项基准测试使用 nanogpt 训练仅前 3% 进度的 checkpoint,并在对比图表中隐藏 y 轴标签,属学术不诚实。被引原文指出,该对比图发布于 fineweb 验证损失 5.0 nats 处,这一损失值高到根本不在 nanogpt-small 训练曲线图内。原文还称,此阶段大部分信号只是把低概率 token 的 logits 推向负无穷,真正的特征学习尚未开始,模型能力差异 largely 是噪声。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月6日
  1. AGI Hunt
    用 nanogpt 训练前 3% 的 checkpoint 做 benchmark 还藏 y 轴标签,被批学术不端

    有人指责用 nanogpt 训练仅前 3% 进度的 checkpoint 做基准测试并隐藏图表 y 轴标签,属学术不诚实。被引原文指出,对比图发布于 fineweb 验证损失 5.0 nats 处,该损失值高到根本不在 nanogpt-small 训练曲线图内。此阶段大部分信号只是把低概率 token 的 logits 推向负无穷,真正的特征学习尚未开始,模型能力差异 largely 是噪声。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。