【发布时间】:2020-11-15 04:49:13
【问题描述】:
我正在处理以熊猫系列形式呈现的直方图,并表示观察集中随机变量的实现。我正在寻找一种有效的方式来存储和读取它们。
直方图的 bin 是 Series 的索引。例如:
histogram1 :
(-1.3747106810983318, 3.529160051186781] 0.012520
(3.529160051186781, 8.433030783471894] 0.013830
(8.433030783471894, 13.336901515757006] 0.016495
(13.336901515757006, 18.24077224804212] 0.007194
(18.24077224804212, 23.144642980327234] 0.041667
(23.144642980327234, 28.048513712612344] 0.000000
我想将其中几个直方图存储在一个 csv 文件中(每组随机变量一个文件,一个文件将存储约 100 个直方图),并在稍后完全按照存储前的方式读取它们(每个直方图从文件中作为单个系列,所有值作为浮点数)。
我该怎么做?既然速度很重要,有没有比 csv 文件更有效的方法?
因此,当一个变量的新实现出现时,我会从相应的文件中检索它的直方图并评估它“落入”的 bin。像这样:
# Not very elegant
for bin in histogram1.index:
if 1.0232545 in bin:
print("It's in!")
print(histogram1.loc[bin])
谢谢!
【问题讨论】:
标签: python pandas csv histogram