【发布时间】:2015-05-19 02:20:41
【问题描述】:
我正在尝试使用 pandas 自动执行一些数据清理工作。
我在一个文件夹中有几个单独的 .csv 文件。我想将所有这些 csv 文件读入数据框,然后在 df 中创建一个 ID 列,其中的值将是每个 csv 文件的名称。
假设使用 glob 读取以下文件:
1.csv
2.csv
3.csv
rawfiles = glob.glob(path + "/*.csv")
tempframe = []
for file_ in rawfiles:
df = pd.read_csv(file_, header=0)
tempframe.append(df)
但在将它们全部连接到一个数据框之前,我想添加一个ID 列并将每个文件的名称作为其值(即1、2、3 等)
我该怎么做呢?
【问题讨论】: