跳到正文
热点事件持续更新

NVIDIA 提交 PyTorch Grace 架构 CPU 传输文档 PR

1 篇报道1 个报道来源3 小时前更新

先了解这件事

AI 综述

2026 年 10 月 7 日,据 AGI Hunt 报道,NVIDIA 的 Krishna Kalyan 向 PyTorch 提交了一份文档 PR,新增关于 NVLink-C2C 系统(Grace Hopper、Grace Blackwell)上 .cpu() 数据传输的说明。该 PR 指出,在这类系统上,CPU↔GPU 拷贝的性能瓶颈位于 CPU 一侧,而不是互连带宽;文档并提到复用 pinned(页锁定)缓冲区这一做法。报道称,此 PR 揭示的是 Grace 架构下 .cpu() 调用的隐性瓶颈,目前信息仅来自这份文档提交,尚无后续进展披露。

AI 根据报道生成 · 3 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. AGI Hunt
    PyTorch 新文档揭示 Grace 架构 .cpu() 隐性瓶颈:复用 pinned 缓冲区

    NVIDIA 的 Krishna Kalyan 为 PyTorch 提交文档 PR,指出 NVLink-C2C 系统(Grace Hopper、Grace Blackwell)上 CPU↔GPU 拷贝瓶颈在 CPU 侧而非带宽。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。