跳到正文
原文
AGI Hunt· vulcan4d·· 3 小时前AI 评分39

ik_llama.cpp 真的更快吗:多 GPU 实测反被 mainline llama.cpp 大幅超越

ik_llama.cpp 真的更快吗:多 GPU 实测反被 mainline 大幅超越

AI 导读

Reddit 用户 vulcan4d 在 4 卡异构机器上实测 Qwen 3.8 Flash-Next 177B(约 89GB,32k 上下文),ik_llama.cpp 反而全面落后 mainline llama.cpp。

来源:AGI Hunt · agihunt.info