【发布时间】:2012-07-09 17:10:42
【问题描述】:
我想使用两个 PBO 以替代方式读取像素。我以为PBO的方式会快很多,因为glReadPixels在使用PBO的时候会立即返回,而且很多时间可以重叠。
奇怪的是似乎没有多少好处。考虑如下代码:
glBindBufferARB(GL_PIXEL_PACK_BUFFER_ARB, 0);
Timer t; t.start();
glReadPixels(0,0,1024,1024,GL_RGBA, GL_UNSIGNED_BYTE, buf);
t.stop(); std::cout << t.getElapsedTimeInMilliSec() << " ";
glBindBufferARB(GL_PIXEL_PACK_BUFFER_ARB, pbo);
t.start();
glReadPixels(0,0,1024,1024,GL_RGBA, GL_UNSIGNED_BYTE, 0);
t.stop(); std::cout << t.getElapsedTimeInMilliSec() << std::endl;
结果是
1.301 1.185
1.294 1.19
1.28 1.191
1.341 1.254
1.327 1.201
1.304 1.19
1.352 1.235
PBO方式稍微快一点,但不是很满意立即返回。
我的问题是:
- 影响 glReadPixels 性能的因素是什么?有时,它的成本达到 10 毫秒,但这里是 1.3 毫秒。
为什么 立即返回 花费高达 1.2 毫秒?是太大还是正常?
================================================ ==============================
根据一个demo对比,我发现了两个因素:
- GL_BGRA 优于 GL_RGBA,1.3ms=>1.0ms(无 PBO),1.2ms=>0.9ms(有 PBO)
- glutInitDisplayMode(GLUT_RGB|GLUT_ALPHA) 而不是 GLUT_RGBA, 0.9ms=>0.01ms。这就是我想要的性能。在我的系统中,GLUT_RGBA=GLUT_RGB=0。 GLUT_ALPHA=8
还有两个问题:
- 为什么 GL_BGRA 优于 GL_RGBA?是只针对特定平台还是针对所有平台?
- 为什么 GLUT_ALPHA 如此重要以至于它会极大地影响 PBO 的性能?
【问题讨论】:
-
ooo 刚刚自己在我的系统上测试了这个 GLUT_RGBA 330 fps GLUT_RGB|GLUT_ALPHA 630fps 增加了 2 倍错过了 GLUT_ALPHA 的重要性。
-
对于 macOS 上的我来说,我必须确保我的缓冲区大小是 2 的幂!否则带有 PBO 的 glReadPixels 会阻塞
标签: opengl glreadpixels pbo