【发布时间】:2014-04-02 00:32:45
【问题描述】:
据我所知,Cuda 流和 memorycpyasync 需要我们将不同的内核、内存操作标记到不同的流,以使 gpu 操作与 cpu 操作并发。
但是是否有可能拥有一个持久内核。该内核启动一次,永远循环,检查“一些标志”以查看是否有一条数据来自 CPU,然后对其进行操作。当这“一块”数据完成时,GPU 为 CPU 设置一个“标志”,CPU 看到它并将数据复制回来。这个内核永远不会结束运行。
这在当前的 cuda 编程模型中是否存在?我能得到的最接近这个的是什么?
【问题讨论】: