跳到正文
原文
AGI Hunt· airesearch12·· 2 小时前AI 评分26

JevBench 将扩充评测:新增 LLM 路由、RAG 检索与内容审核任务

JevBench 将扩充评测:LLM 路由、RAG 检索与内容审核任务 incoming

AI 导读

JevBench 作者宣布将为「Jev 级」模型扩充更多典型用例评测,方向包括在 LLM Auto Router 中按成本/能力与冷热缓存选择路由哪个模型、RAG pipeline 的搜索与检索增强任务,以及内容审核与不良内容标记。即将发布的版本会包含上述方向的大量测试任务。

来源:AGI Hunt · agihunt.info