AGI Hunt· ChengleiSi·· 4 小时前AI 评分44
评测盲区:Fable 与 Astra 等 AI 科研 agent 做事风格迥异,榜单却只看一个分数
评测盲区:不同 AI 科研 agent 做事风格迥异,榜单却只看一个分数
AI 导读
同一任务下,AI 科研 agent Fable 与 Astra 展现出完全不同的「性格」:Fable 鼓励尝试更大目标,Astra 建议先跑试点、逐项验证证据。AI 科研的过程如今首次被完整记录在日志里,研究者可直接对「研究过程本身」做基准评测,而不必把科学探索压缩成榜单上的一个分数。
来源:AGI Hunt · agihunt.info