热点事件持续更新
四卡7900XTX优化ROCm,27B推理提速近一倍
1 篇报道1 个报道来源3 小时前更新
先了解这件事
AI 综述
2026年10月7日报道,有网友借助 Claude 协助,为 ROCm 与 llama.cpp 完成了 20 余项底层优化,并将这些优化公开。据其披露,在 4 张 AMD 7900XTX 上运行 Qwen3.8-27B Q8 模型,代码生成解码速度从原先的 54-61 tok/s 提升到 96-110 tok/s,接近翻倍;51K 上下文的预填充速度也从 1454 tok/s 提升到 1816 tok/s。报道称作者已公开这 20 余项 ROCm 优化,供他人在同类多卡 AMD 平台上使用。
AI 根据报道生成 · 2 小时前更新
最新进展10月7日 07:06
作者公开20余项ROCm与llama.cpp底层优化,四卡7900XTX跑27B提速近一倍。报道时间线
沿着报道,了解事件的不同侧面。
10月7日
- AGI Hunt四卡 7900XTX 跑 Qwen3.8-27B 提速近一倍,作者公开 20 余项 ROCm 优化
有人用 Claude 协助为 ROCm 和 llama.cpp 做了 20 余项底层优化,在 4 张 7900XTX 上运行 Qwen3.8-27B Q8,代码生成解码从 54-61 提升到 96-110 tok/s,51K 上下文预填充从 1454 提升到 1816 tok/s。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。