【发布时间】:2018-11-13 04:47:38
【问题描述】:
我有一个非常大的数据文件 (foo.sas7bdat),我想从中过滤行而不将整个数据文件加载到内存中。例如,我可以通过执行以下操作打印数据集的前 20 行,而无需将整个文件加载到内存中:
import pandas
import itertools
with pandas.read_sas('foo.sas7bdat') as f:
for row in itertools.islice(f,20):
print(row)
但是,我不清楚如何仅打印(或最好放置在新文件中)具有包含数字 123.1 的任何列的行。我该怎么做?
【问题讨论】:
标签: python pandas sas statistics