热点事件持续更新
实测本地模型吞吐量与代码能力倒挂
1 篇报道1 个报道来源2 小时前更新
先了解这件事
AI 综述
2026 年 10 月,一位用户自建评测 harness,用 Ollama 跑提示词、提取代码块,并以 tsc --strict 编译验证,在 RTX 5070 Ti、Q4KM、8192 上下文条件下测试本地模型。结果发现吞吐量与代码能力倒挂:qwen3:30b-a3b 吞吐最快,比 14b 快 33%、比 devstral 快 3.7 倍,却是唯一两次代码测试都没产出可编译代码块的模型,其代码被写成散文式文本。目前该结论来自这一用户的自建评测。
AI 根据报道生成 · 1 小时前更新
最新进展10月2日 10:50
新实测显示 qwen3:30b-a3b 吞吐最快,却两次代码测试均无可编译输出。报道时间线
沿着报道,了解事件的不同侧面。
10月2日
- AGI Hunt实测:qwen3:30b-a3b 吞吐最快却写不出可编译代码
一位用户自建评测 harness,用 Ollama 跑提示词、提取代码块并用 tsc --strict 编译验证,在 RTX 5070 Ti、Q4KM、8192 上下文下发现吞吐量与能力倒挂:qwen3:30b-a3b 比 14b 快 33%、比 devstral 快 3.7 倍,却是唯一两次代码测试都没产出可编译代码块的模型,代码被写成散文式文本。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。