【发布时间】:2020-03-02 21:47:43
【问题描述】:
所以我一直在尝试将 .csv 文件与 Pandas 合并,并尝试创建几个函数来自动化它,但我一直遇到问题。 我的问题是我想在另一个之后堆叠一个.csv(相同的列数和不同的行数),但是我没有获得具有相同列数的更大的csv,而是获得了具有更多列和行的更大的csv(正确的行数,错误的列数(比应该的列数更多))。 我使用的代码是这个:
import os
import pandas as pd
def stackcsv(content_folder):
global combined_csv
combined_csv= []
entries = os.listdir(content_folder)
for i in entries:
csv_path = os.path.join(content_folder, i)
solo_csv = pd.read_csv(csv_path,index_col=None)
combined_csv.append(solo_csv)
csv_final = pd.concat(combined_csv,axis = 0,ignore_index=True)
return csv_final.to_csv("final_data.csv",index = None, header = None)
我有 3.csv 文件,大小为 20000x17,我想将其合并为 60000x17 之一。我想我的错误必须在索引、标题、index_col 等的参数中...... 提前致谢。
【问题讨论】:
-
文件是否有标题行?
-
不,没有标题。稍后再添加。