【发布时间】:2011-06-22 09:23:20
【问题描述】:
我有一个程序,我在 GPU 上进行大量计算,然后在 CPU 上使用这些结果进行内存操作,然后如果有数据,我会获取下一批数据并从头到尾执行相同的操作。现在,如果我可以先进行第一组计算,然后在我的 CPU 处理内存操作时从第二批开始,那会快很多。我该怎么做?
【问题讨论】:
-
“内存操作” - 你的意思是数据到卡/从卡的传输,还是与卡无关的东西?你不是只需要一个线程来管理卡,然后你就可以对 CPU 的其余部分做任何你想做的事了吗?
-
我猜都是。我将结果传输到主机,然后对数据做一些事情,所以它并不是真正独立的。
标签: cuda