跳到正文
原文
AGI Hunt· CurieuxExplorer·· 2 天前AI 评分33

87GB 大模型 Qwen3.8 Flash Next 单卡 RTX 5090 跑到 150 t/s

AI 导读

87GB 的 Qwen3.8 Flash Next 由日本用户用本地推理工具 Strata 实测,在单张 RTX 5090 上以 150 t/s 运行,Prefill 达 4K t/s。该模型接入 LibreChat 并开启 Web 搜索后可正常检索,且护栏宽松。评论认为「需要数据中心」的时代受到冲击,Qwen 级模型已成桌面级玩法。

来源:AGI Hunt · agihunt.info