【发布时间】:2013-02-22 19:13:16
【问题描述】:
嗯,在 nVidia 论坛 (https://devtalk.nvidia.com/default/topic/458062/atomicadd-float-float-atomicmul-float-float-/) 上找到了解决方案。
谢谢。
【问题讨论】:
-
由于您拥有 Compute 1.1 GPU,您可以使用原子操作将同时写入到同一内存位置的序列化。
-
CUDA 编程指南 3.1 - B.11.1.1:atomicAdd() 的浮点版本仅支持计算能力为 2.0 的设备。
-
@eg141840 sgar91 没有说你应该使用 atomicAdd,他说原子操作(hint 任何原子操作都可以基于 atomicCAS() hint i>)