算力百科COMPUTEPEDIA

算力百科 › 技术概念 › GPUDirect

GPUDirect

NVIDIA GPUDIRECT · 技术概念词条

概述OVERVIEW

GPUDirect 是 NVIDIA 的 GPU 直接通信技术族——让数据绕过 CPU 和系统内存、在 GPU 与外部设备之间建立直通路径。GPUDirect RDMA 让网卡直接读写 GPU 显存(省掉 CPU 中转拷贝);GPUDirect Storage 让存储数据直达 GPU 显存(省掉 CPU 中转);NVLink 则是 GPU 之间的直连。

AI 训练和推理都受益于 GPUDirect:训练时 AllReduce 梯度同步走 GPUDirect RDMA;推理时 KV cache 从存储直达 GPU 显存(GPUDirect Storage);多机多卡 fabric 走 GPUDirect+RDMA——整条数据通路没有 CPU 中转瓶颈。

关键数字KEY NUMBERS

项目数值 / 口径
GPUDirect RDMA网卡↔GPU 显存直通
GPUDirect StorageNVMe/存储→GPU 显存直通
配套硬件ConnectX 网卡 + 支持 P2P 的 PCIe 拓扑
软件栈CUDA + NCCL + GPUDirect Storage SDK

在 B300 上的意义ON B300

B300 全系支持 GPUDirect——GB200/GB300 NVL72 的跨机 fabric(ConnectX-8)和柜内 NVLink 域都走 GPUDirect 路径。采购互连件(网卡/交换机/线缆)时,GPUDirect 兼容性列表逐项核对是验收的必要项——第三方模块可能物理插上但 GPUDirect 不通。

边界与注意LIMITS

  • GPUDirect 需要 PCIe 拓扑配合:GPU 和网卡必须在同一 PCIe Root Complex 下——跨 NUMA 节点的 P2P 性能会下降,服务器选型时 PCIe 拓扑是核心验收项。
  • 第三方存储/网卡兼容性参差:GPUDirect Storage 的兼容列表由 NVIDIA 维护——非列表内的设备可能出现「能跑但性能打折」的情况。

参考资料REFERENCES

  1. NVIDIA 官网 — Blackwell Ultra / HGX B300 产品页 https://www.nvidia.com/en-us/data-center/hgx/
  2. 行情与在售数据:萬安算交所(本库行情带)
版本与勘误|本词条由算力百科编辑部维护,AI 辅助起草、人工核验事实。更新于 2026-10-10 · 版本 v1.0 · 历次改动均留痕可查。
本库
编辑政策关于本库(利益声明)勘误通道
编辑宪法摘要
每条断言带出处缺点必写 · 勘误公开留痕不接受付费词条词条内零导流与销售元素行情数据仅作数据模块挂载
萬安家族
算力百科萬安算交所萬安资讯
行情数据来源:萬安算交所 · © 2026 算力百科 ComputePedia · 萬安出品