跳到正文
热点事件持续更新

Mac mini M5 本地跑 Qwen Flash Next 实测

1 篇报道1 个报道来源5 小时前更新

先了解这件事

AI 综述

2026年10月5日,AGI Hunt 报道,Reddit 用户 turtleninja99 在 64GB 内存的 Mac mini M5 上本地运行 Qwen Flash Next 的 Q4 量化模型。由于显存放不下全部 MoE 专家权重,作者采用热专家留在缓存、其余权重从 SSD 流式加载的方案。经自行优化后,解码速度约 17.5 tks,提示词处理约 360 tks。报道同时指出,解码过程中仍有约 27% 的时间在等待磁盘读取,说明本地运行大型 MoE 模型依然受存储带宽制约。

AI 根据报道生成 · 57 分钟前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月5日
  1. AGI Hunt
    玩家在 64GB Mac mini M5 上本地跑 Qwen Flash Next

    Reddit 用户 turtleninja99 在 64GB Mac mini M5 上本地运行 Qwen Flash Next Q4 量化模型,自优化后解码约 17.5 tks、提示词处理约 360 tks。因显存放不下全部 MoE 专家权重,作者采用热专家留缓存、其余从 SSD 流式加载的方案。但解码时仍有约 27% 的时间在等待磁盘读取,显示本地跑大 MoE 模型仍受存储带宽制约。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。