热点事件持续更新
Mac mini M5 本地跑 Qwen Flash Next 实测
1 篇报道1 个报道来源5 小时前更新
先了解这件事
AI 综述
2026年10月5日,AGI Hunt 报道,Reddit 用户 turtleninja99 在 64GB 内存的 Mac mini M5 上本地运行 Qwen Flash Next 的 Q4 量化模型。由于显存放不下全部 MoE 专家权重,作者采用热专家留在缓存、其余权重从 SSD 流式加载的方案。经自行优化后,解码速度约 17.5 tks,提示词处理约 360 tks。报道同时指出,解码过程中仍有约 27% 的时间在等待磁盘读取,说明本地运行大型 MoE 模型依然受存储带宽制约。
AI 根据报道生成 · 57 分钟前更新
报道时间线
沿着报道,了解事件的不同侧面。
10月5日
- AGI Hunt玩家在 64GB Mac mini M5 上本地跑 Qwen Flash Next
Reddit 用户 turtleninja99 在 64GB Mac mini M5 上本地运行 Qwen Flash Next Q4 量化模型,自优化后解码约 17.5 tks、提示词处理约 360 tks。因显存放不下全部 MoE 专家权重,作者采用热专家留缓存、其余从 SSD 流式加载的方案。但解码时仍有约 27% 的时间在等待磁盘读取,显示本地跑大 MoE 模型仍受存储带宽制约。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。