【发布时间】:2015-10-14 00:52:13
【问题描述】:
我需要动态分配大部分 GPU 全局内存,比如说 64 MB,这会花费很多时间;分配完成后,将开始复制到/从分配的空间。我想知道是否可以将 64 MB 分配为较小的块(例如 1 MB)并在每个分配的块上启动异步复制?请注意,我希望最终分配的空间是连续的。
另一个问题,不存在异步 cudaMalloc 或与之等效的任何东西,对吧?
【问题讨论】:
-
谢谢 Greogr,我的意思是另外一回事,我的意思是关于在 GPU 上运行的其他指令。但是,这是一个很好的观点“内存分配通常在页数中是 O(n)”。这也适用于 cudaMalloc 吗?你能在这里提供一个参考吗?