AGI Hunt· swagonflyyyy·· 3 小时前AI 评分40
Ninfer 在 Blackwell 上实测 130-180 t/s,远快于 llama-server
Ninfer 在 Blackwell 上实测 130-180 t/s,远快于 llama-server
AI 导读
Reddit 用户实测新推理后端 Ninfer:在 Blackwell MaxQ GPU 上以 qwen3.8-27b-nvfp4(Dflash2、MTP-7 配置)跑出 130-180 tokens/s,远快于 llama-server。
来源:AGI Hunt · agihunt.info