【发布时间】:2021-10-12 16:31:47
【问题描述】:
我正在对 cuSolver CUDA 库中的稀疏矩阵使用 QR 和 LU 分解和求解函数。根据文档,LU 功能仅在主机路径上可用,而 QR 功能在设备上也可用。
我想知道是否有任何设置或类似的设置来控制主机和设备功能的并行化设置。两种函数的线程数如何控制?
【问题讨论】:
我正在对 cuSolver CUDA 库中的稀疏矩阵使用 QR 和 LU 分解和求解函数。根据文档,LU 功能仅在主机路径上可用,而 QR 功能在设备上也可用。
我想知道是否有任何设置或类似的设置来控制主机和设备功能的并行化设置。两种函数的线程数如何控制?
【问题讨论】:
没有任何并行化设置。
线程的数量不能直接控制,并且没有公开描述函数在你所要求的级别上是如何工作的。
图书馆是不透明的。与由库调用启动的任何内核调用关联的线程数将由库使用的启发式方法确定,但未描述。
【讨论】: