【发布时间】:2019-04-18 00:52:42
【问题描述】:
我正在尝试分析一些数据,为此我正在通过编写一些由其他 CSV 文件组成的行来创建一个新的 CSV 文件。我已经从其中一个文件 (oldfile1) 中提取了数据,所以它是一个列表(带有我用来附加到新文件的特定索引),但另一个 (oldfile2) 我用于文件的基础,因此我可以直接添加该文件中的行,因为它们不需要过滤。新行的公式应为row from oldfile2 + row from oldfile1。 first 打算跳过评论行。然而,这段代码目前创建了一个非常大的输出文件(200MB)——我怀疑它每行循环多次,复制了写入的行。但是,我不能立即想到另一种方法来确保 oldfile2 中的行被循环,同时不复制写入的行。我也无法提供有关输出文件的更多详细信息,因为每当我尝试打开它时它就会崩溃。任何帮助表示赞赏。
with open('newfile.csv','w+') as f:
reader = csv.reader(open('oldfile2.csv'), delimiter=',')
writer = csv.writer(f, delimiter=',')
first = next(reader)
for oldrow2 in reader:
outline = [oldrow2 + oldfile1[i] for i in oldfile1_indices]
writer.writerow(outline)```
【问题讨论】:
-
这似乎适用于
zip()。类似于for oldrow1, oldrow2 in zip(odlfile1, oldfile2): write_new_line() -
你的错误是
[oldrow2 + oldfile1[i] for i in oldfile1_indices]它连接oldrow2与 oldfile1 中的每一行 - 而不是一行它创建了许多行。
标签: python file csv file-handling