【发布时间】:2014-04-08 19:35:15
【问题描述】:
我已经实现了一个内核来处理输入来自cudaTextureObject_t 的数据。为了增加我的方法的吞吐量,我用 N 个不同的流对象调用这个内核。因此,我创建了 N 个纹理对象,然后将它们传递给不同的内核调用。
这在具有 Kepler 架构的 GPU 上运行良好。但是,现在我想在具有 Fermi 架构的 GPU 上也使用此方法,其中没有可用的 cudaTextureObject_t。
我的问题如下:有没有办法根据纹理引用进行抽象,还是我必须为旧架构完全重写我的代码?
【问题讨论】:
标签: cuda