为什么SXM在GPU上优于PCIe | AI生成和翻译

首页 2026.07

问题: 为什么 PCIe 形态在 GPU(例如 H100/H200/MI300X)上不如 SXM?

答案:

按实际影响排序的核心原因:

1. 互连带宽(主要因素)

2. 供电

3. 散热

4. 拓扑结构 / 全互联

对你而言的实际数值: 在 8 块 H100 SXM 上,针对 7B 参数梯度同步的 all-reduce 耗时约个位数毫秒。同样的操作在 8 块 H100 PCIe(无 NVLink 桥接)上可能慢 5-10 倍,直接降低 MFU(模型 FLOPs 利用率)——这就是为什么进行严肃预训练的云服务商(以及为什么你的 MI300X 设备很重要)默认采用 SXM/OAM 基板,而 PCIe 卡则定位于推理或单/双 GPU 推理工作负载(此时互连不是瓶颈)。

具体到 MI300X,它采用 OAM(开放加速器模块,AMD 的 SXM 等效方案)并配备 Infinity Fabric——同样的情况:每 GPU 聚合带宽 896 GB/s,相比之下,假设中的 PCIe 版 MI300X(AMD 实际上并未推出)将被 Gen5 x16 限制。

参考文献:


AI生成和翻译,但整理分享仍需精力。如果觉得有帮助,欢迎 捐助支持。 微信:@lzwjavaWeChat QR · X: @lzwjava · 打个招呼 👋

返回 捐助