跳到正文
原文
AGI Hunt· SaxenaNayan·· 3 小时前AI 评分46

Periodic Labs:AI 预测实验能力激增

AI 导读

Periodic Labs 独立测试显示,模型预测实验结果的能力自 GPT-4 Turbo 以来显著提升,在 1,173 个实验上按当前趋势 2030 年 10 月可弥合与真实结果 90% 的差距。另一组对比显示,Opus 5.5 的「实验研究品味」达到其最佳人类专家的 2.3 倍。典型任务仅用约 17 GPU 小时即可达到专家 40 小时的水平,单次实验成本约为后者的 1/30。

来源:AGI Hunt · agihunt.info