【发布时间】:2017-09-16 02:12:47
【问题描述】:
我在 NVIDIA 上使用对 OpenCL 2.0 的测试版支持,并针对 1080ti 等高端 GPU。在我的计算管道中,我有时需要分派工作来独立地处理相对较小的图像。理论上,我认为这些图像应该能够在单个 GPU 上并行处理,因为单个图像的工作组数量不会使 GPU 的所有计算单元饱和。
这在 OpenCL 中可行吗?这在 OpenCL 中有名称吗?
如果可能的话,为单个设备使用多个队列是唯一的方法吗?或者驱动程序会查看“waitEventList”并决定哪些内核可以并行处理?
我需要 CL_QUEUE_OUT_OF_ORDER_EXEC_MODE_ENABLE 吗?
【问题讨论】: