【发布时间】:2014-06-18 12:35:48
【问题描述】:
这是我遇到的问题的精简版:
我有一个包含许多(可能是数百万)数据集的文件,它们都在同一个组中,如下所示:
"/组" + Dataset0001 [双数组2到3维和大量数据] + 数据集0002 + 数据集0003 + ... + 数据集XXXX
数据集被分块并写在一个循环中,该循环在每次迭代期间只知道每个数据集的一部分。因此,在每次迭代中,所有数据集都会发生不完整的写入。这意味着我必须用数据集的名称形成字符串,并告诉 HDF5 查找它并获取句柄,以便我可以写入它。
这很慢。
有没有办法通过使用文件中数据的偏移量来更快地获取句柄?
【问题讨论】: