AGI Hunt· pcuenq·· 3 小时前AI 评分44
oMLX 0.7.0 发布:长上下文解码提速 50%,重写内存守护
oMLX 0.7.0 发布:长上下文解码提速 50%,重写内存守护
AI 导读
Mac 端 MLX 推理栈 oMLX 发布 0.7.0,长上下文解码相比 rc1 提速 50%。Qwen3.8-27B 在 M3 Ultra、64K 上下文的 decode 从 46.9 升至 70.3 tok/s。新版本完全重写 memory guard,并为 GLM-5.3-Flash 加入 DFlash2 支持。
来源:AGI Hunt · agihunt.info