【发布时间】:2012-08-02 17:53:36
【问题描述】:
我有 GeForce GTX460 SE,所以它是:6 SM x 48 CUDA 核心 = 288 CUDA 核心。 众所周知,一个 Warp 包含 32 个线程,而在一个块中同时(一次)只能执行一个 Warp。 即在单个多处理器(SM)中只能同时执行一个Block、一个Warp和只有32个线程,即使有48个内核可用?
此外,可以使用threadIdx.x和blockIdx.x来分配具体的Thread和Block的示例。要分配它们,请使用内核 >> ()。 但是如何分配特定数量的 Warp-s 并分发它们,如果不可能,那为什么还要费心去了解 Warp?
【问题讨论】:
-
您问题的第一段大部分内容完全不正确,因此您的问题的其余部分没有多大意义。