【发布时间】:2021-06-28 13:16:11
【问题描述】:
我有一些看起来像这样的代码:
import pandas as pd
import glob
root_directory = r"\\some\shared\directory"
all_files = glob.glob(f'{root_directory}\CPE_*.csv')
li = []
for filename in all_files:
frame = pd.read_csv(filename, index_col=None, header=0, encoding='latin1')
li.append(frame)
df = pd.concat(li, axis=0, ignore_index=True)
此代码允许我连接数据并创建一个主 csv 文件,但我想在循环遍历它们时为每个数据框添加一个新列。文件名如下所示: CPE_02082020.csv 、 CPE_02092020 等。因此日期在文件名本身中,格式为 mmddyyyy。如何在循环和连接每个文件时为每个文件添加日期列?
【问题讨论】:
-
每个新文件只会添加一列?文件的行数是否相等?
-
不是所有文件的行数都不相同。只是想在这个主数据框中添加 1 个“日期”列。
标签: python-3.x pandas loops date glob