跳到正文
热点事件持续更新

网传Opus 5.5实验判断力匹敌人类专家

1 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

2026年10月7日,AGI Hunt 报道,网传「Opus 5.5」在 TasteVal 基准上判断“哪些实验值得做”的能力已匹敌最强人类专家,而完成这些实验所需的算力消耗约为人类专家的 1/2.3;报道还称该能力大约每 3 个月翻倍。推主 rynorhn 据此评论称,数百万个不疲倦、可并行开展实验的智能体,将把拥有“几百万研究者”的文明变成“无限研究者”,关键转折在于科研规模出现数量级跃升。相关说法目前均为网传与外部评论,报道未给出基准的具体细节或第三方验证。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. AGI Hunt
    「Opus 5.5」被曝选实验能力匹敌人类专家,耗算力仅 2.3 分之一

    网传「Opus 5.5」在 TasteVal 基准上判断哪些实验值得做的能力匹敌最强人类专家,实验算力消耗约为其 1/2.3。该能力据称每 3 个月翻倍。推主 rynorhn 据此称,数百万个不疲倦、可并行实验的智能体将把“几百万研究者”的文明变成“无限研究者”,转折在于科研规模数量级跃升。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。