跳到正文
原文
AGI Hunt· pcuenq·· 3 小时前AI 评分44

oMLX 0.7.0 发布:长上下文解码提速 50%,重写内存守护

oMLX 0.7.0 发布:长上下文解码提速 50%,重写内存守护

AI 导读

Mac 端 MLX 推理栈 oMLX 发布 0.7.0,长上下文解码相比 rc1 提速 50%。Qwen3.8-27B 在 M3 Ultra、64K 上下文的 decode 从 46.9 升至 70.3 tok/s。新版本完全重写 memory guard,并为 GLM-5.3-Flash 加入 DFlash2 支持。

来源:AGI Hunt · agihunt.info