【发布时间】:2016-09-16 23:14:34
【问题描述】:
我正在用 Python3.5 编写一个程序,它读取一个数据集并做一些事情(如果你熟悉的话,它是 DICOM 数据)。它使用:
- 大小为 (512,512,141) 或更大的大型数组。
- 大量小元数据(许多单个数据条目)。
现在我的程序有许多不同的组件,它们都将使用相同的数据集。我的问题是处理这些数据的最佳做法是什么?我:
- 通过内部变量传递数据?我觉得这是对内存/空间的低效使用,因为每次我必须将数据向下传递(不破坏数据的来源)时,它都会不必要地添加资源?
- 使用文件存储系统?当我这么说时,我指的是 SQL、HDF5 甚至是 python 中的值字典。
- 每次需要时读取数据?因此,例如我必须导入库、加载文件、在文件中搜索 var、存储 var 并再次关闭文件。看起来很乏味。
哪种方法最好?我不会访问这些数据一次或两次,而是访问 20 多次。有没有我不知道应该使用的方法?
在此先感谢您,我非常重视您的帮助(以及必要时的批评),以始终提高自己作为程序员和人类的水平。
【问题讨论】:
标签: python external internals datahandler