热点事件持续更新
网传Opus 5.5实验判断力匹敌人类专家
1 篇报道1 个报道来源2 小时前更新
先了解这件事
AI 综述
2026年10月7日,AGI Hunt 报道,网传「Opus 5.5」在 TasteVal 基准上判断“哪些实验值得做”的能力已匹敌最强人类专家,而完成这些实验所需的算力消耗约为人类专家的 1/2.3;报道还称该能力大约每 3 个月翻倍。推主 rynorhn 据此评论称,数百万个不疲倦、可并行开展实验的智能体,将把拥有“几百万研究者”的文明变成“无限研究者”,关键转折在于科研规模出现数量级跃升。相关说法目前均为网传与外部评论,报道未给出基准的具体细节或第三方验证。
AI 根据报道生成 · 2 小时前更新
最新进展10月7日 08:56
新报道称Opus 5.5判断实验价值能力匹敌人类专家,耗算力仅2.3分之一,且约每3个月翻倍。报道时间线
沿着报道,了解事件的不同侧面。
10月7日
- AGI Hunt「Opus 5.5」被曝选实验能力匹敌人类专家,耗算力仅 2.3 分之一
网传「Opus 5.5」在 TasteVal 基准上判断哪些实验值得做的能力匹敌最强人类专家,实验算力消耗约为其 1/2.3。该能力据称每 3 个月翻倍。推主 rynorhn 据此称,数百万个不疲倦、可并行实验的智能体将把“几百万研究者”的文明变成“无限研究者”,转折在于科研规模数量级跃升。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。