跳到正文
热点事件持续更新

实测本地模型吞吐量与代码能力倒挂

1 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

2026 年 10 月,一位用户自建评测 harness,用 Ollama 跑提示词、提取代码块,并以 tsc --strict 编译验证,在 RTX 5070 Ti、Q4KM、8192 上下文条件下测试本地模型。结果发现吞吐量与代码能力倒挂:qwen3:30b-a3b 吞吐最快,比 14b 快 33%、比 devstral 快 3.7 倍,却是唯一两次代码测试都没产出可编译代码块的模型,其代码被写成散文式文本。目前该结论来自这一用户的自建评测。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月2日
  1. AGI Hunt
    实测:qwen3:30b-a3b 吞吐最快却写不出可编译代码

    一位用户自建评测 harness,用 Ollama 跑提示词、提取代码块并用 tsc --strict 编译验证,在 RTX 5070 Ti、Q4KM、8192 上下文下发现吞吐量与能力倒挂:qwen3:30b-a3b 比 14b 快 33%、比 devstral 快 3.7 倍,却是唯一两次代码测试都没产出可编译代码块的模型,代码被写成散文式文本。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。