【发布时间】:2022-01-16 13:46:08
【问题描述】:
我正在使用 glob() 来读取目录中的所有文件。我需要读取所有子文件夹中的每个 csv 文件。在我阅读并处理每个文件后,我想将每个新文件保存在另一个文件夹中,但保留子文件夹名称。打开我使用的文件:
data = "data/**/*.csv"
csv_files = glob(data, recursive=True)
然后我读取每个文件:
for f in csv_files:
file = pd.read_csv(f, sep=';')
fileName = os.path.basename(f)
path = os.path.dirname(data)
fileFolder = os.path.basename(path)
# Do some stuff
#
# Then save the file
file.to_csv("new_data/"+fileFolder+fileName)
我的问题是 fileFolder 返回 ** 而不是实际的文件夹名称
我的源目录如下:
data /
- January 2021
- February 2021
.
.
.
- December 2021
我想把我的文件保存在
new_data /
- January 2021
- February 2021
.
.
.
- December 2021
我正在寻找一种不需要手动创建包含所有子文件夹的列表的方法。
【问题讨论】:
标签: pandas dataframe directory export-to-csv glob