【发布时间】:2011-10-12 19:41:24
【问题描述】:
我目前正在使用一个应用程序,它产生一堆 pthreads (linux),每个线程都创建它自己的 CUDA 上下文。 (现在使用 cuda 3.2)。
我遇到的问题是,似乎每个线程都有自己的上下文会在 GPU 上消耗大量内存。每个线程大约 200MB,所以这真的限制了我。
我可以简单地在主机线程中创建流,将流引用传递给工作线程,然后它们就可以将它们的流编号传递给我的 CUDA 库,并且所有工作都在同一个上下文中工作吗?
工作线程是否自动知道与其父线程相同的 CUDA 上下文?
谢谢
【问题讨论】:
标签: c++ cuda cuda-context