【发布时间】:2016-05-05 04:43:07
【问题描述】:
我在我的系统中的不同 pci 插槽中安装了两个 GPU(2x Nvidia Quadro 410)。为了解决这两个 GPU 上的 Martix 乘法,我如何拆分输入矩阵,以便每个 GPU 处理/计算输出矩阵的一部分,然后将其返回。 例如。对于两个矩阵 A, B 每个顺序 10x10 ,然后计算输出矩阵 C= A x B ,这样,在 100 个元素(10 x 10)中,应在第一个 GPU 上计算 50 个元素,另一半即 50 到b 在第二个 GPU 中计算。 我正在尝试在 OpenCL 上实现它。但是,欢迎任何有助于我提出解决方案的算法。
【问题讨论】:
标签: matrix opencl matrix-multiplication hpc multi-gpu