热点事件持续更新
网友感慨两年间AI数学能力反差巨大
1 篇报道1 个报道来源2 小时前更新
先了解这件事
AI 综述
2026年10月7日,AGI Hunt报道称,网友 Yuchenj_UW 感慨两年间AI数学能力的巨大反差:2024年,GPT-4o 连「9.9 是否大于 9.11」这样的比较题都答错,而如今最难的数学问题也让人感觉即将被 AI 解决。同一报道提到,OpenAI 宣称已解决 372 个此前未解的难题,平均每题约耗时 3 小时;此外,Cagliostro V3.5 135M 以智能指数 27.49 登上 Open SLM 榜单首位,超过 SmolLM2。报道以这些事例对比两年前后的模型表现,呈现外界对 AI 数学能力快速提升的关注。
AI 根据报道生成 · 1 小时前更新
最新进展10月7日 11:02
网友感慨GPT-4o曾答错9.9与9.11比较,如今AI已能解决372个未解难题。报道时间线
沿着报道,了解事件的不同侧面。
10月7日
- AGI Hunt从 GPT-4o 的 9.9>9.11 翻车到挑战最难数学题:两年 AI 反差
Yuchenj_UW 感慨两年 AI 反差:2024 年 GPT-4o 连「9.9 是否大于 9.11」都答错,如今最难的数学问题也感觉将被 AI 解决。同期 OpenAI 宣称解决 372 个未解难题,平均每题约耗 3 小时;Cagliostro V3.5 135M 以智能指数 27.49 登顶 Open SLM 榜,超过 SmolLM2。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。