跳到正文
原文
AGI Hunt· burny_tech·· 1 天前AI 评分40

SemiAnalysis 拆解 GLM-5.3:稀疏注意力为何没能省下 HBM 内存

SemiAnalysis 拆解 GLM-5.3:稀疏注意力为何没能省下 HBM 内存

AI 导读

SemiAnalysis 分析指出,GLM-5.3 的稀疏注意力虽降低了 KV cache 带宽与访存需求,但 top-k 选择需完整上下文驻留 HBM,内存容量瓶颈未被消除。

来源:AGI Hunt · agihunt.info