跳到正文
热点事件持续更新

多卡实测 ik_llama.cpp 性能落后 mainline llama.cpp

1 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

2026 年 10 月 7 日,AGI Hunt 报道称,Reddit 用户 vulcan4d 在一台 4 卡异构机器上对 ik_llama.cpp 与 mainline llama.cpp 进行了对比实测,测试模型为 Qwen 3.8 Flash-Next 177B,模型体积约 89GB,上下文设为 32k。结果显示,ik_llama.cpp 的实测性能反而全面落后于 mainline llama.cpp,并未体现出预期的速度优势。报道以“ik_llama.cpp 真的更快吗”为切入点,指出这次多 GPU 实测中 mainline llama.cpp 大幅超越 ik_llama.cpp。目前该结论来自单一用户的实测,报道未提供更详细的测试配置说明、逐项数据或第三方复现结果,事件仍停留在这一轮实测引发的讨论阶段。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. AGI Hunt
    ik_llama.cpp 真的更快吗:多 GPU 实测反被 mainline llama.cpp 大幅超越

    Reddit 用户 vulcan4d 在 4 卡异构机器上实测 Qwen 3.8 Flash-Next 177B(约 89GB,32k 上下文),ik_llama.cpp 反而全面落后 mainline llama.cpp。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。