跳到正文
热点事件持续更新

AMD 称 MI355X 输出 token 成本降 31%

1 篇报道1 个报道来源3 小时前更新

先了解这件事

AI 综述

AMD 高管 Ryan Shrout 引用第三方机构 Signal65 的 PINNACLE 实测数据称,在 MiniMax-M3 推理场景下,于同节点、同负载、同一 vLLM 构建条件下,仅将配置更换为 AMD 官方 serving 配置,MI355X 峰值吞吐即提升 11%,轻载时单 agent 解码速度提升 2.4 倍。AMD 官方由此晒出账目:软件调优叠加 vLLM 升级后,输出 token 成本直降 31%。目前公开信息仅包含上述实测结论与提升幅度,未披露测试的完整环境配置、对比基线及成本核算口径。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月3日
  1. AGI Hunt
    AMD 官方晒账:MI355X 软件调优叠加 vLLM 升级,输出 token 成本直降 31%

    AMD 高管 Ryan Shrout 引用 Signal65 的 PINNACLE 实测称,MI355X 在 MiniMax-M3 推理上同节点、同负载、同 vLLM 构建,仅更换 AMD 官方 serving 配置,峰值吞吐提升 11%,轻载下单 agent 解码速度提升 2.4 倍。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。