【发布时间】:2018-08-28 22:53:33
【问题描述】:
我有几个与 cuda 编程和 GPU 架构相关的问题要问:
1.假设GPU的显存带宽为144 Gb/s,PCIe总线带宽为2.25 Gb/s,将一个100,000,000个double的数组传输到GPU需要多少毫秒?
2.鉴于GPU全局内存的大小为3Gb,你可以处理的最大数组大小是多少?如果你必须处理一个更长的数组,你怎么能改变你的程序来完成这个?
这个我不知道怎么计算,谁能帮帮我,谢谢
【问题讨论】:
标签: c++ architecture cuda gpu cpu