【发布时间】:2016-06-14 21:14:44
【问题描述】:
我有 Python 3.4 和 Pandas 0.17。我注意到我的程序需要大约 30 秒来读取泡菜文件。
df= pd.read_csv(a, skiprows=[1])
df.to_pickle(b)
df2 = pd.read_pickle(b) --- This line takes almost 30 seconds.
原始 csv 文件约为 185 MB(2967000 行),pickle 文件为 125 MB。
我有另一个工作正常的泡菜文件(~95 MB)(可以在
【问题讨论】:
-
可以交换吗?如果你将它读入同一个变量需要多长时间:
df = pd.read_pickle(b)而不是df2? -
我的代码 sn-p 的最后一行实际上在不同的程序中(Line#1,2 - file1.py 和 Line#3- file2.py)。但是我还是尝试了您的建议,但没有帮助。
标签: python performance pandas pickle