AGI Hunt· scott_linderman·2026-10-03 01:23· 4 小时前AI 评分51EurekaBench 发布:AI 科学 agent 擅长解题却难以产出科学洞见EurekaBench:AI agent 擅长解题,却难以产出真正科学洞见AI 导读Howard Chen 与 Jiayi Geng 等人发布 EurekaBench,衡量 AI 科学 agent 的一个关键缺口:它们擅长在目标明确时优化求解,却未必能加深人类对科学的理解。来源:AGI Hunt · agihunt.info#论文/研究#Agent查看事件全部后续