【发布时间】:2017-07-12 12:18:50
【问题描述】:
给定一个包含 DataFrame 的 pandas HDFStore:
import pandas as pd
import numpy.random as rd
df = pd.DataFrame(rd.randn(int(1000)).reshape(500, 2), columns=list('ab'))
store = pd.HDFStore('store.h5')
store.append('df', df, data_columns=['a', 'b'])
我可以使用select 函数来检索数据的子集,如下所示:
store.select('df', ['a > 0', 'b > 0'])
但是,如果我使用不在HDFStore 中的普通DataFrame,我可以通过回退到我可能使用的那种命令来获得相同的输出:
store.df[(store.df.a > 0) & (store.df.b > 0)]
这两种方法有区别吗?如果有,有什么区别?
【问题讨论】:
标签: python python-2.7 pandas hdfstore