跳到正文
热点事件持续更新

网友感慨两年间AI数学能力反差巨大

1 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

2026年10月7日,AGI Hunt报道称,网友 Yuchenj_UW 感慨两年间AI数学能力的巨大反差:2024年,GPT-4o 连「9.9 是否大于 9.11」这样的比较题都答错,而如今最难的数学问题也让人感觉即将被 AI 解决。同一报道提到,OpenAI 宣称已解决 372 个此前未解的难题,平均每题约耗时 3 小时;此外,Cagliostro V3.5 135M 以智能指数 27.49 登上 Open SLM 榜单首位,超过 SmolLM2。报道以这些事例对比两年前后的模型表现,呈现外界对 AI 数学能力快速提升的关注。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. AGI Hunt
    从 GPT-4o 的 9.9>9.11 翻车到挑战最难数学题:两年 AI 反差

    Yuchenj_UW 感慨两年 AI 反差:2024 年 GPT-4o 连「9.9 是否大于 9.11」都答错,如今最难的数学问题也感觉将被 AI 解决。同期 OpenAI 宣称解决 372 个未解难题,平均每题约耗 3 小时;Cagliostro V3.5 135M 以智能指数 27.49 登顶 Open SLM 榜,超过 SmolLM2。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。