【发布时间】:2012-12-18 19:35:29
【问题描述】:
我想对一个大型数据集进行分区并将工作拆分到多个 GPU 上。我想让这些数据静态化,这样我就不必在第二次运行时加载到 GPU。现在的问题是,pthread_create 要求将所有输入数据组装成一个“结构”,我不确定将一堆静态数据组装成一个结构是否可行。感谢您的任何建议。
【问题讨论】:
-
pthread_create和 CUDA 有什么关系? -
我希望有另一种选择,但 Sanders 的“CUDA 示例”通过使用 pthread_create 为非默认 GPU 创建新线程演示了一个多 GPU 示例。
-
要使用非默认GPU,我们必须创建一个新线程,对吧?或者干脆调用运行时“cudaSetDevice”就可以了?
-
自 CUDA 4 发布以来,您无需为多个 GPU 使用单独的主机线程。你需要看看this GTC presentation。
-
很棒的资源!快速浏览一下 powerpoint 告诉我“cudaSetDevice”将使多个 GPU 异步运行,但稍后会研究它!