【发布时间】:2019-04-12 17:34:30
【问题描述】:
我正在寻找一个线程安全的替代 hdf5 的替代品,以便在多处理环境中读取,并偶然发现zarr,根据基准,据说它基本上是 python 环境中 h5py 的直接替代品。
我试过了,到目前为止一切都很好,但我无法理解 zarr 输出的文件数量。
如果我使用 h5py 写入 h5 文件,则只有一个文件结果,而 zarr 似乎在子文件夹中输出随机数量的文件。
有人能解释一下为什么会这样吗?创建文件的确切数量取决于什么?
提前致谢
【问题讨论】:
标签: python parallel-processing zarr