【发布时间】:2020-04-18 11:30:11
【问题描述】:
我有一个名为 df_list 的大量数据框列表(包含一些不同的列和一些常见的列),我希望将其合并到一个大数据框中。我尝试了以下方法:
all_dfs = pd.concat(df_list)
虽然这在单个内核上花费了太多时间。我在 48 小时后杀死了脚本。您将如何并行化此过程以使用我所有的内核或重写代码以使其更快
【问题讨论】:
标签: python pandas multithreading parallel-processing