热点事件持续更新
Ai2 发布论文解释 Olmo 3 长上下文训练差异
1 篇报道1 个报道来源10 小时前更新
先了解这件事
AI 综述
Ai2 在训练 Olmo 3 时遇到一个谜题:两个模型在短上下文评测上表现几乎一致,且使用完全相同的训练数据,但在长上下文扩展后行为却截然不同。2026 年 10 月 6 日,Ai2 研究者 abertsch72 发布论文《Cracks in the Foundation》,对这一谜题作出解释。论文作者 kylelostat 将携该论文与 7B 混合架构模型 Olmo Hybrid 一同参加 COLM 2026 会议。目前公开报道仅涉及论文发布与会议安排,尚未披露具体成因或实验细节。
AI 根据报道生成 · 4 小时前更新
报道时间线
沿着报道,了解事件的不同侧面。
10月6日
- AGI HuntAi2 新论文解谜 Olmo 3 训练:短上下文相当的两模型长上下文表现迥异
Ai2 研究者 abertsch72 发布论文 Cracks in the Foundation,解释训练 Olmo 3 时发现的一个谜题:两个模型在短上下文评测上几乎表现一致、使用完全相同的训练数据,但在长上下文扩展后行为却截然不同。作者 kylelostat 将携该论文与 7B 混合架构模型 Olmo Hybrid 参加 COLM 2026 会议。
本事件热度走势
当前热度 8·可比范围峰值 8(10月6日 15:00)·近 24 小时可比范围变化 –
趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。