跳到正文
热点事件持续更新

用户实测 Strata 跑 Qwen3-Next 达 45-50 tok/s

1 篇报道1 个报道来源1 小时前更新

先了解这件事

AI 综述

2026年10月3日,AGI Hunt 报道了一位 Reddit 用户的本地推理实测:该用户用 Strata 方案加载 Qwen3-Next 的 IQ3XXS 量化权重,权重体积在约 80GB 以下,运行环境为慢速 DDR4 内存加 RX 7900XTX 显卡,结果稳定跑到约 45-50 tok/s。作为对照,同一台机器上经调优的 llama.cpp 仅约 22.5 tok/s,即 Strata 方案的吞吐约为其两倍。目前该结果来自个人实测,报道未提及更广泛的复现或官方说明。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月3日
  1. AGI Hunt
    Reddit 用户实测 Strata 跑 Qwen3-Next 达 45-50 tok/s,快于同机 llama.cpp

    一位 Reddit 用户实测用 Strata 方案加载 Qwen3-Next 的 IQ3XXS 量化权重(约 80GB 以下),在慢速 DDR4 内存加 RX 7900XTX 上稳定跑到约 45-50 tok/s,而同机调优后的 llama.cpp 仅约 22.5 tok/s。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。