热点事件持续更新
Cerebras CEO称晶圆级推理比GPU快2500倍
1 篇报道1 个报道来源4 小时前更新
先了解这件事
AI 综述
Cerebras 联合创始人兼 CEO Andrew Feldman 此前公开表示,其晶圆级架构在 LLM 推理上比 GPU 快 2500 倍,这一说法构成事件起点。2026 年 10 月 3 日,AGI Hunt 报道称,Feldman 在 The MAD Podcast 上进一步解释了该差距的来源:他把差异归结为权重存放位置的不同——GPU 的权重放在 HBM,而 Cerebras 把权重放在分布式的晶圆级处理器 SRAM 中,这让 decode 阶段每生成一个 token 所必需的「内存→计算」搬运快约 2500 倍。报道中并未给出第三方复现或独立测试结果,2500 倍仍属 Cerebras 方面的说法。
AI 根据报道生成 · 2 小时前更新
最新进展10月3日 06:24
Feldman 在播客中解释称,2500 倍差距源于权重放在晶圆级 SRAM 而非 HBM。报道时间线
沿着报道,了解事件的不同侧面。
10月3日
- AGI HuntCerebras CEO 揭秘:晶圆级架构推理为何比 GPU 快 2500 倍
Cerebras 联合创始人兼 CEO Andrew Feldman 在 The MAD Podcast 上解释,其晶圆级架构在 LLM 推理时比 GPU 快 2500 倍。他把差异归结于权重存放位置:GPU 的权重放在 HBM,Cerebras 则把权重放在分布式的晶圆级处理器 SRAM 中,使 decode 阶段每生成一个 token 必需的「内存→计算」搬运快约 2500 倍。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。