【问题标题】:How to write a CSV file combining 2 other CSV rows (Python)如何编写结合其他 2 个 CSV 行的 CSV 文件(Python)
【发布时间】:2019-04-18 00:52:42
【问题描述】:

我正在尝试分析一些数据,为此我正在通过编写一些由其他 CSV 文件组成的行来创建一个新的 CSV 文件。我已经从其中一个文件 (oldfile1) 中提取了数据,所以它是一个列表(带有我用来附加到新文件的特定索引),但另一个 (oldfile2) 我用于文件的基础,因此我可以直接添加该文件中的行,因为它们不需要过滤。新行的公式应为row from oldfile2 + row from oldfile1first 打算跳过评论行。然而,这段代码目前创建了一个非常大的输出文件(200MB)——我怀疑它每行循环多次,复制了写入的行。但是,我不能立即想到另一种方法来确保 oldfile2 中的行被循环,同时不复制写入的行。我也无法提供有关输出文件的更多详细信息,因为每当我尝试打开它时它就会崩溃。任何帮助表示赞赏。

with open('newfile.csv','w+') as f:
        reader = csv.reader(open('oldfile2.csv'), delimiter=',')
        writer = csv.writer(f, delimiter=',')
        first = next(reader)
        for oldrow2 in reader:
                outline = [oldrow2 + oldfile1[i] for i in oldfile1_indices]
                writer.writerow(outline)```


【问题讨论】:

  • 这似乎适用于zip()。类似于for oldrow1, oldrow2 in zip(odlfile1, oldfile2): write_new_line()
  • 你的错误是 [oldrow2 + oldfile1[i] for i in oldfile1_indices] 它连接 oldrow2 与 oldfile1 中的每一行 - 而不是一行它创建了许多行。

标签: python file csv file-handling


【解决方案1】:

我无法测试它,但我认为您需要 zip() 创建对 (oldrow2, i) 然后创建新行并保存

oldfile1 = list(csv.reader(open('oldfile1.csv'), delimiter=','))
oldfile1_indices = [...]

with open('newfile.csv','w+') as f:
    writer = csv.writer(f, delimiter=',')

    reader2 = csv.reader(open('oldfile2.csv'), delimiter=',')
    next(reader2)

    for oldrow2, i in zip(reader2, oldfile1_indices):
        outline = [oldrow2 + oldfile1[i]]
        writer.writerow(outline)

【讨论】:

  • 啊,是的,我在前面的步骤中使用了 zip。我想我认为 Python 可以因为 for 循环而隐式地解释索引,但我想不是。完美的解决方案,谢谢。
猜你喜欢
  • 1970-01-01
  • 1970-01-01
  • 2016-05-01
  • 2015-07-29
  • 1970-01-01
  • 2015-09-18
  • 2018-11-19
  • 1970-01-01
  • 1970-01-01
相关资源
最近更新 更多