AGI Hunt· Reno0vacio·· 5 小时前AI 评分50
Toolery 基准实测 15 个本地模型工具调用:qwen3.8-27B 居首,Bonsai 27B 垫底
15 个本地模型工具调用实测:qwen3.8-27B 居首,Bonsai 27B 垫底
AI 导读
作者用 Toolery 基准实测 15 个本地模型的 agent 与工具调用能力,qwen3.8-27b 以 71.8% 居首,mellum2-12b-a2.5b-thinking 71.4%、gemma-4-26b-a4b 70.4% 紧随其后,prism-ml/bonsai-27b 以 50.5% 垫底。
来源:AGI Hunt · agihunt.info