【发布时间】:2014-11-16 13:28:17
【问题描述】:
我想将一个大数组加载到 GPU 共享内存。 当我像下面这样使用它时:
1: int index = threadidx.x;
2: 共享无符号字符 x[1000];
3: x[i] = 数组[i];
那么如果我们调用一个有 1000 个线程和一个块的内核代码,每个线程都会发生一次内存访问? 是否可以通过一次内存访问加载此数组并将其加载到共享内存?
任何建议将不胜感激。
【问题讨论】:
标签: c cuda shared-memory memory-access