【发布时间】:2017-04-06 11:50:37
【问题描述】:
我正在尝试在 3x3 矩阵和 360x360 矩阵之间进行矩阵乘法。较小的矩阵 (3x3) 将使用大矩阵的第一个 (3x3) 块进行操作,依此类推。因此,我希望拥有较小的矩阵常量并将其滑过较大的矩阵。
是否可以将较小的矩阵存储为共享内存的一部分,并将较大的矩阵在全局范围内划分为 3x3?
我没有找到将较小的矩阵复制到直接从主机共享的方法。如果我对 cuda 的可视化是错误的,请纠正我。
谢谢。
【问题讨论】:
-
您无法从主机复制到共享内存。不支持。
标签: c++ matrix cuda nvidia gpgpu