AGI Hunt· pschwllr·2026-10-02 04:02· 5 小时前AI 评分35GOLLuM 回顾基准成绩:找 Top-5% 结果命中率 36.3% 胜描述符 29.7%AI 导读GOLLuM 将语言模型与高斯过程配对来选择下一个实验,在 Schwaller 团队的 23 个回顾性基准测试中,其主变体找到 36.3% 的 top-5% 最优结果,高于基于描述符优化的 29.7%。这些结果来自数据集检索,并非真实实验室试验。来源:AGI Hunt · agihunt.info#论文/研究#评测/基准查看事件全部后续