跳到正文
原文
AGI Hunt· Reno0vacio·· 5 小时前AI 评分50

Toolery 基准实测 15 个本地模型工具调用:qwen3.8-27B 居首,Bonsai 27B 垫底

15 个本地模型工具调用实测:qwen3.8-27B 居首,Bonsai 27B 垫底

AI 导读

作者用 Toolery 基准实测 15 个本地模型的 agent 与工具调用能力,qwen3.8-27b 以 71.8% 居首,mellum2-12b-a2.5b-thinking 71.4%、gemma-4-26b-a4b 70.4% 紧随其后,prism-ml/bonsai-27b 以 50.5% 垫底。

来源:AGI Hunt · agihunt.info