AGI Hunt· airesearch12·· 2 小时前AI 评分26
JevBench 将扩充评测:新增 LLM 路由、RAG 检索与内容审核任务
JevBench 将扩充评测:LLM 路由、RAG 检索与内容审核任务 incoming
AI 导读
JevBench 作者宣布将为「Jev 级」模型扩充更多典型用例评测,方向包括在 LLM Auto Router 中按成本/能力与冷热缓存选择路由哪个模型、RAG pipeline 的搜索与检索增强任务,以及内容审核与不良内容标记。即将发布的版本会包含上述方向的大量测试任务。
来源:AGI Hunt · agihunt.info