热点事件持续更新
M3 Max 本地推理实测:Qwen3.6 MoE 达 110 tok/s
1 篇报道1 个报道来源10 小时前更新
先了解这件事
AI 综述
2026 年 10 月 5 日,有作者以约 2498 美元购入 14 核 M3 Max MacBook Pro(内存 36GB),在 macOS 27 上对四款本地推理引擎做实测。测试模型为 Qwen3.6-35B-A3B MoE,参与对比的引擎包括 oMLX 0.7.0、Rapid-MLX 0.15.5、Splash 1.2.1 和 MTPLX 2.12.2。结果显示 Rapid-MLX 最快,达到 110.2 tok/s,oMLX 为 104.2 tok/s。报道未给出 Splash 与 MTPLX 的具体成绩,也未披露量化方式、上下文长度等测试条件。
AI 根据报道生成 · 2 小时前更新
最新进展10月5日 23:11
实测显示 Rapid-MLX 跑 Qwen3.6-35B-A3B MoE 达 110.2 tok/s,为四款引擎中最快。报道时间线
沿着报道,了解事件的不同侧面。
10月5日
- AGI HuntM3 Max 36GB 本地推理实测:Qwen3.6 MoE 达 110 tok/s
作者花约 2498 美元购入 14 核 M3 Max MacBook Pro(36GB),在 macOS 27 上实测 oMLX 0.7.0、Rapid-MLX 0.15.5、Splash 1.2.1、MTPLX 2.12.2 四款本地推理引擎,Qwen3.6-35B-A3B MoE 上 Rapid-MLX 最快达 110.2 tok/s,oMLX 104.2 tok/s。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。