跳到正文
原文
AGI Hunt· Ch4spec·· 3 小时前AI 评分52

实测:qwen3:30b-a3b 吞吐最快却写不出可编译代码

实测:最快模型写不出可编译代码,吞吐量与能力倒挂

AI 导读

一位用户自建评测 harness,用 Ollama 跑提示词、提取代码块并用 tsc --strict 编译验证,在 RTX 5070 Ti、Q4KM、8192 上下文下发现吞吐量与能力倒挂:qwen3:30b-a3b 比 14b 快 33%、比 devstral 快 3.7 倍,却是唯一两次代码测试都没产出可编译代码块的模型,代码被写成散文式文本。

来源:AGI Hunt · agihunt.info