跳到正文
热点事件持续更新

M3 Max 本地推理实测:Qwen3.6 MoE 达 110 tok/s

1 篇报道1 个报道来源10 小时前更新

先了解这件事

AI 综述

2026 年 10 月 5 日,有作者以约 2498 美元购入 14 核 M3 Max MacBook Pro(内存 36GB),在 macOS 27 上对四款本地推理引擎做实测。测试模型为 Qwen3.6-35B-A3B MoE,参与对比的引擎包括 oMLX 0.7.0、Rapid-MLX 0.15.5、Splash 1.2.1 和 MTPLX 2.12.2。结果显示 Rapid-MLX 最快,达到 110.2 tok/s,oMLX 为 104.2 tok/s。报道未给出 Splash 与 MTPLX 的具体成绩,也未披露量化方式、上下文长度等测试条件。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月5日
  1. AGI Hunt
    M3 Max 36GB 本地推理实测:Qwen3.6 MoE 达 110 tok/s

    作者花约 2498 美元购入 14 核 M3 Max MacBook Pro(36GB),在 macOS 27 上实测 oMLX 0.7.0、Rapid-MLX 0.15.5、Splash 1.2.1、MTPLX 2.12.2 四款本地推理引擎,Qwen3.6-35B-A3B MoE 上 Rapid-MLX 最快达 110.2 tok/s,oMLX 104.2 tok/s。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。