【发布时间】:2021-01-10 02:08:09
【问题描述】:
我有一个包含大约 2800 万行(5 列)的数据框,我正在努力将它写入一个限制为 1,048,576 行的 Excel,我不能在多个工作簿中拥有它,所以我会需要将 28Mi 拆分成 28 张等等。
这就是我正在做的:
writer = pd.ExcelWriter('NAME_XX-' + mes +'-' + ano + '_XXX.xlsx', engine = "xlsxwriter")
notMor.to_excel(writer, engine='xlsxwriter', index=False)
我很难将数据框分成 27 个不同的数据框,然后将每个数据框保存在工作簿上,但没有更简单的方法吗?
【问题讨论】:
-
您可以使用
df.groupby(df.index//1000000)来获得 28 个分组的子 dfs...但是复制那么多数据,拆分成许多工作表,对于 excel 来说不是一个好习惯。您最好创建一个二进制文件文件并从excel连接到它,粘贴数据后你将如何处理excel? -
我很难将数据框分成 27 个不同的数据框,然后将每个数据框保存在工作簿上,但没有更简单的方法吗? 那有多难? for 循环应该可以解决问题,对吧?
-
我需要一个工作簿中的数据,而不需要任何指向另一个文件的链接。我知道这将是一个巨大的 xlsx 文件,需要很长时间才能打开,但这是我必须呈现的。我想我必须拆分 df,我希望像传递给“to_excel”的参数之类的东西可以限制行数,然后继续创建和填充新工作表。
-
@LucasMarques 你解决过这个问题吗?我有一个非常相似的问题。
标签: python excel pandas dataframe