【发布时间】:2015-09-04 04:09:12
【问题描述】:
我有多个文件夹,每个文件夹都包含 csv。我正在尝试连接每个子目录中的 csv,然后将其导出。最后,我将拥有与文件夹相同数量的输出。最后我想要 Folder1.csv、Folder2.csv、...Folder99.csv 等。这就是
import os
from glob import glob
import pandas as pd
import numpy as np
rootDir = 'D:/Data'
OutDirectory = 'D:/OutPut'
os.chdir(rootDir)
# The directory has folders as follows
# D:/Data/Folder1
# D:/Data/Folder2
# D:/Data/Folder3
# ....
# .....
# D:/Data/Folder99
# Each folders (Folder1, Folder2,..etc.) has many csvs.
frame = pd.DataFrame()
list_ = []
for (dirname, dirs, files) in os.walk(rootDir):
for filename in files:
if filename.endswith('.csv'):
df = pd.read_csv(filename,index_col=None, na_values=['-999'], delim_whitespace= True, header = 0, skiprows = 2)
OutFile = '%s.csv' % OutputFname
list_.append(df)
frame = pd.concat(list_)
df.to_csv(OutDirectory+OutFile, sep = ',', header= True)
我收到以下错误:
IOError: File file200150101.csv does not exist
【问题讨论】:
标签: python-2.7 csv pandas