【发布时间】:2019-09-23 10:48:45
【问题描述】:
我正在从帧缓冲区读取单个像素的深度以实现拾取。最初我的 glReadPixels() 需要很长时间(5ms 左右),而在 nVidia 上它甚至会在这段时间内burn 100% CPU。在 Intel 上它也很慢,但是 CPU 空闲。
从那时起,我使用 PixelBufferObject 功能 PBO 来使 glReadPixels 异步并且还使用 this well known example 进行双缓冲。
这种方法效果很好,让我进行 glReadPixels() 异步调用但前提是我读取 RGBA 值。如果我使用相同的 PBO 方法来读取深度值,则 glReadPixels() 会再次阻塞。
读取 RGBA:glReadPixels() 需要 12µs。
读取深度:glReadPixels() 需要 5ms。
我在 nVidia 和 Intel 驱动程序上试过这个。具有不同的格式/类型组合。我试过了:
glReadPixels( srcx, srcy, 1, 1, GL_DEPTH_COMPONENT, GL_FLOAT, 0 );
和:
glReadPixels( srcx, srcy, 1, 1, GL_DEPTH_STENCIL, GL_UNSIGNED_INT_24_8, 0 );
和:
glReadPixels( srcx, srcy, 1, 1, GL_DEPTH_STENCIL, GL_FLOAT_32_UNSIGNED_INT_24_8_REV, 0 );
这些都不会导致异步 glReadPixels() 调用。但是,如果我通过以下调用读取 RGBA 值:
glReadPixels( srcx, srcy, 1, 1, GL_RGBA, GL_UNSIGNED_BYTE, 0 );
然后 glReadPixels() 立即返回,因此不再阻塞。
在读取单个像素之前,我会这样做:
glReadBuffer( GL_FRONT );
glBindBuffer( GL_PIXEL_PACK_BUFFER, pboid );
我创建了双缓冲 PBO:
glGenBuffers( NUMPBO, pboids );
for ( int i=0; i<NUMPBO; ++i )
{
const int pboid = pboids[i];
glBindBuffer( GL_PIXEL_PACK_BUFFER, pboid );
glBufferData( GL_PIXEL_PACK_BUFFER, DATA_SIZE, 0, GL_STREAM_READ );
...
我使用深度大小为 24、模板大小为 8 和默认双缓冲区的 SDL2 创建帧缓冲区。
我在 Ubuntu LTS 上使用 OpenGL Core Profile 3.3。
【问题讨论】:
-
深度缓冲区的实际格式是什么?如果渲染到具有特定 OpenGL 图像格式的 FBO 会发生什么?
-
@nicol 我怎么知道?我可以查询吗?我从 SDL2 请求 24b 深度和 8b 模板,所以可能期待 GL_UNSIGNED_INT_24_8?
-
"在读取单个像素之前,我会做
glReadBuffer( GL_FRONT );" 那只影响颜色缓冲区,深度缓冲区没有双缓冲,所以它实际上可以解释差异。很难说到底发生了什么,因为渲染循环的其余部分是未知的,但即使在 PBO 代码路径中也有可能强制同步(可能只是使用一些以前的帧而不是最近的帧)。 -
@derhass 我实际上并没有读取像素深度(通过 glMapBuffer)直到下一帧,所以没有同步进行。 glReadPixel 应该触发了异步操作并立即返回(就像 RGBA 一样)。但它没有,为了阅读深度。
-
好吧,对于 Intel 案例,mesa 可以很好地告诉您发生了什么(使用调试回调!):
intel_texsubimage_blorp: GL_DEPTH_COMPONENT not supported; intelReadPixels: fallback to CPU mapping in PBO case; CPU mapping a busy "isl-miptree" BO stalled and took 33.192 ms.。这将引导您到this bug report。英伟达是做什么的,我不知道。
标签: opengl depth-buffer glreadpixels pbo