热点事件持续更新
AMD 称 MI355X 输出 token 成本降 31%
1 篇报道1 个报道来源3 小时前更新
先了解这件事
AI 综述
AMD 高管 Ryan Shrout 引用第三方机构 Signal65 的 PINNACLE 实测数据称,在 MiniMax-M3 推理场景下,于同节点、同负载、同一 vLLM 构建条件下,仅将配置更换为 AMD 官方 serving 配置,MI355X 峰值吞吐即提升 11%,轻载时单 agent 解码速度提升 2.4 倍。AMD 官方由此晒出账目:软件调优叠加 vLLM 升级后,输出 token 成本直降 31%。目前公开信息仅包含上述实测结论与提升幅度,未披露测试的完整环境配置、对比基线及成本核算口径。
AI 根据报道生成 · 2 小时前更新
最新进展10月3日 01:57
AMD 高管披露 Signal65 实测细节:峰值吞吐 +11%、轻载解码快 2.4 倍,支撑 31% 成本降幅。报道时间线
沿着报道,了解事件的不同侧面。
10月3日
- AGI HuntAMD 官方晒账:MI355X 软件调优叠加 vLLM 升级,输出 token 成本直降 31%
AMD 高管 Ryan Shrout 引用 Signal65 的 PINNACLE 实测称,MI355X 在 MiniMax-M3 推理上同节点、同负载、同 vLLM 构建,仅更换 AMD 官方 serving 配置,峰值吞吐提升 11%,轻载下单 agent 解码速度提升 2.4 倍。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。