AGI Hunt· vulcan4d·· 3 小时前AI 评分39
ik_llama.cpp 真的更快吗:多 GPU 实测反被 mainline llama.cpp 大幅超越
ik_llama.cpp 真的更快吗:多 GPU 实测反被 mainline 大幅超越
AI 导读
Reddit 用户 vulcan4d 在 4 卡异构机器上实测 Qwen 3.8 Flash-Next 177B(约 89GB,32k 上下文),ik_llama.cpp 反而全面落后 mainline llama.cpp。
来源:AGI Hunt · agihunt.info