【问题标题】:cudaMemcpy device to distant hostcudaMemcpy 设备到远程主机
【发布时间】:2013-04-10 13:44:22
【问题描述】:

我正在做一个在主机上运行并使用 GPU 进行计算的模拟。计算完成后,主机将内存从设备复制到自身,然后将计算的数据发送到远程主机。

基本上数据会做:GPU -> HOST -> NETWORK CARD

由于模拟是实时的,所以时间很重要,我想要这样的东西:GPU -> NETWORKCARD,以减少数据传输的延迟。

有可能吗? 如果不是,我们有朝一日会看到吗?

编辑:远程主机 => CPU

【问题讨论】:

标签: networking cuda data-transfer


【解决方案1】:

是的,这在 CUDA 4.0 和更高版本中可以在支持统一直接寻址的平台上使用GPUDirect facility(我认为现阶段基本上是带有 Fermi 或 Kepler Telsa 卡的 linux)。您对“远程主机”的含义没有多说,但是如果您有一个 MPI 可行的网络,那么可能有一个现成的解决方案供您使用。

至少mvapich2 已经支持使用 Infiniband 或 TCP/IP 进行 GPU-GPU 传输,包括通过 PCI express 总线直接到 Infiniband 适配器的 RDMA。到目前为止,其他 MPI 实现可能也得到了支持,尽管我最近没有仔细研究过它,无法确定。

【讨论】:

  • GPUDirect 似乎只是 GPU-GPU P2P,我的远程主机是 CPU。
猜你喜欢
  • 1970-01-01
  • 2011-09-09
  • 2012-02-09
  • 2018-02-06
  • 2021-01-25
  • 2011-08-24
  • 1970-01-01
  • 1970-01-01
相关资源
最近更新 更多