【发布时间】:2021-12-20 23:46:43
【问题描述】:
我有 30 个文件夹(从 2021-06-01 到 2021-06-30),每个文件夹中有 15 个 excel 文件。目前我分别使用此代码 30 次
file1= glob.glob('C:/Users/Dell/Downloads/2021-06-01/*')
制作一个文件file1,为每个文件夹运行数据处理操作(进入15个excel文件)。这样我就可以有file 1到file 30然后我concat他们制作一个文件。
有什么方法可以自动化这个过程,因为我不想单独运行这个操作 30 次?我没有弄清楚如何为此创建一个循环来从不同的路径中提取文件。
我也有数据,但它们被压缩在文件夹中(从 2021-06-01 到 2021-06-30)。所以,一个个去那里解压然后一个个运行操作是很繁琐的。
我怎样才能以更简单的方式实现这两个目的?我通过搜索看到了解压操作解决方案,我无法做到,同时我还必须获得我提到的另一个目的(遍历不同的文件夹并一次一个地提取它们,使file 1 到file 30 一次)
我的目录看起来像:
- download
-month
-2021-01-01
-AA
-file.zip
-a list of .xlsx file
-BB
-CC
-2021-01-02
-AA
-file.zip
-a list of .xlsx file
-BB
-CC
...........................................................................................................................................................................
-2021-01-30
现在我不想连接这些 xlsx 文件。我想对这些excel文件一个一个地运行某个操作,然后将它们连接起来。但是不能这样做。
【问题讨论】:
标签: python excel pandas dataframe data-manipulation