跳到正文
原文
AGI Hunt· swagonflyyyy·· 3 小时前AI 评分40

Ninfer 在 Blackwell 上实测 130-180 t/s,远快于 llama-server

Ninfer 在 Blackwell 上实测 130-180 t/s,远快于 llama-server

AI 导读

Reddit 用户实测新推理后端 Ninfer:在 Blackwell MaxQ GPU 上以 qwen3.8-27b-nvfp4(Dflash2、MTP-7 配置)跑出 130-180 tokens/s,远快于 llama-server。

来源:AGI Hunt · agihunt.info