跳到正文
原文
AGI Hunt· EmPips·· 2 小时前AI 评分51

Reddit 用户实测 Strata 跑 Qwen3-Next 达 45-50 tok/s,快于同机 llama.cpp

大内存+入门 GPU 跑 Qwen3-Next:Strata 混合推理达 45-50 tok/s

AI 导读

一位 Reddit 用户实测用 Strata 方案加载 Qwen3-Next 的 IQ3XXS 量化权重(约 80GB 以下),在慢速 DDR4 内存加 RX 7900XTX 上稳定跑到约 45-50 tok/s,而同机调优后的 llama.cpp 仅约 22.5 tok/s。

来源:AGI Hunt · agihunt.info