跳到正文
热点事件持续更新

「爱因斯坦测试」:语言模型难独立完成科学范式突破

1 篇报道1 个报道来源3 小时前更新

先了解这件事

AI 综述

2026年10月3日,AGI Hunt 报道了被称为「爱因斯坦测试」(#EinsteinTest)的思想实验。该测试只向语言模型提供重大理论变革发生之前的证据,观察模型能否自行完成那次突破。结果显示,模型很少能自行完成突破,更常见的表现是重建学界后来已抛弃的旧解释。该观察由 X 用户 CurieuxExplorer 提出,其观点是:在历史科学数据上训练的模型,更擅长重构既有范式,而非作出范式革命。这一测试被视作衡量 AI 科学创造力的思想实验。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月3日
  1. AGI Hunt
    「爱因斯坦测试」:语言模型难以独立完成科学范式突破

    「爱因斯坦测试」(#EinsteinTest)显示,只向语言模型提供重大理论变革之前的证据,模型很少能自行完成那次突破,更常见的表现是重建学界后来已抛弃的旧解释。该观察由 X 用户 CurieuxExplorer 提出,认为在历史科学数据上训练的模型更擅长重构既有范式而非做出范式革命,被视作衡量 AI 科学创造力的思想实验。

本事件热度走势

当前热度 9·可比范围峰值 10(10月3日 12:00)·近 24 小时可比范围变化 –

02.557.51010月3日12:0010月3日13:0010月3日13:0010月3日14:00

趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。