跳到正文
原文
AGI Hunt· PangWeiKoh·· 4 小时前AI 评分32

ScholarCatalyst 基准:测 AI 能否像人一样提出好研究问题

AI 导读

研究者推出 ScholarCatalyst 基准,用于评测 AI 能否复现人类提出研究问题的品味与判断。该基准素材来自 AI 研究者对自己「什么灵感催生了这项工作」的第一手叙述;发布者称这是对「AI 能解决给定问题」之外更难一环的度量——AI 虽已在 Navier-Stokes 等开放问题上取得进展,但定义一个新问题仍依赖人类的研究品味。

来源:AGI Hunt · agihunt.info