跳到正文
热点事件持续更新

Cerebras CEO称晶圆级推理比GPU快2500倍

1 篇报道1 个报道来源4 小时前更新

先了解这件事

AI 综述

Cerebras 联合创始人兼 CEO Andrew Feldman 此前公开表示,其晶圆级架构在 LLM 推理上比 GPU 快 2500 倍,这一说法构成事件起点。2026 年 10 月 3 日,AGI Hunt 报道称,Feldman 在 The MAD Podcast 上进一步解释了该差距的来源:他把差异归结为权重存放位置的不同——GPU 的权重放在 HBM,而 Cerebras 把权重放在分布式的晶圆级处理器 SRAM 中,这让 decode 阶段每生成一个 token 所必需的「内存→计算」搬运快约 2500 倍。报道中并未给出第三方复现或独立测试结果,2500 倍仍属 Cerebras 方面的说法。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月3日
  1. AGI Hunt
    Cerebras CEO 揭秘:晶圆级架构推理为何比 GPU 快 2500 倍

    Cerebras 联合创始人兼 CEO Andrew Feldman 在 The MAD Podcast 上解释,其晶圆级架构在 LLM 推理时比 GPU 快 2500 倍。他把差异归结于权重存放位置:GPU 的权重放在 HBM,Cerebras 则把权重放在分布式的晶圆级处理器 SRAM 中,使 decode 阶段每生成一个 token 必需的「内存→计算」搬运快约 2500 倍。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。