【问题标题】:Written csv file with Python contains wrong format of numbers用 Python 编写的 csv 文件包含错误的数字格式
【发布时间】:2013-11-26 05:58:28
【问题描述】:

此脚本读取一个文本文件,对每列每 3 行取平均值并将其写入 csv 文件:

输入文件:

2013-08-29T15:11:18.55912   0.019494552 0.110042184 0.164076427 0.587849877
2013-08-29T15:11:18.65912   0.036270974 0.097213155 0.122628797 0.556928624
2013-08-29T15:11:18.75912   0.055350041 0.104121094 0.121641949 0.593113069
2013-08-29T15:11:18.85912   0.057159263 0.107410588 0.198122695 0.591797271
2013-08-29T15:11:18.95912   0.05288292  0.102476346 0.172958062 0.591139372
2013-08-29T15:11:19.05912   0.043507861 0.104121094 0.162102731 0.598376261
2013-08-29T15:11:19.15912   0.068343545 0.102805296 0.168517245 0.587849877
2013-08-29T15:11:19.25912   0.054527668 0.105765841 0.184306818 0.587191978
2013-08-29T15:11:19.35912   0.055678991 0.107739538 0.169997517 0.539165352

脚本:

data = loadtxt('infile.txt', usecols = (1,2,3,4))
with open ('out.csv', 'wb') as outfile:
    writer = csv.writer(outfile, delimiter = '\t')
    seg_len = 3       
    for x in range(0, len(data[:,1]), seg_len):
        sample_means = ([x/seg_len], [mean(data[x:x+seg_len,i]) for i in range(4)])
        bi = list(chain.from_iterable(sample_means))
        writer.writerow ((', '.join(map(repr, bi))))

输出 CSV 文件:

0    0.037038...    0.10379...  ...
1    0.051183...    0.10466...  ...
2    00059516...    0.10543...  ...

但是当我打开 csv 文件并对列求和时,它给出了零!好像不是数字。我直接从 CSV 文件复制,它看起来像这样:

"0      "   "   0   .   0   3   7   0   3   8   5   2   2   3   3   3   3   3   3   3   3       "   "   0   .   1   0   3   7   9   2   1   4   4   3   3   3   3   3   3   3   2       "
"1      "   "   0   .   0   5   1   1   8   3   3   4   7   9   9   9   9   9   9   9   9   7       "   "   0   .   1   0   4   6   6   9   3   4   2   6   6   6   6   6   6   6   6       "
"2      "   "   0   .   0   5   9   5   1   6   7   3   4   6   6   6   6   6   6   6   6   1       "   "   0   .   1   0   5   4   3   6   8   9   1   6   6   6   6   6   6   6   6       "

有人可以建议如何解决这个问题吗?

【问题讨论】:

  • 澄清一下,“输出 CSV”下的部分是您期望的部分,而下面的部分是您得到的部分吗?
  • 输出文件完全符合我的预期。但正如我所说,它们只是看起来像数字,但你不能求和,平均......它们应该是数字,以便我可以进行统计分析。下面的一个是从 csv 单元格复制并粘贴到这里。我认为这就是为什么它们不被视为数字但不知道如何处理的原因。

标签: python csv numpy format writer


【解决方案1】:

也许您正在寻找这个?

sample_means = [x/seg_len] + [mean(data[x:x+seg_len,i]) for i in range(4)]
writer.writerow(sample_means)

【讨论】:

  • 这会将两个列表一起写在一个单元格中,而我希望它们在单独的列中。
  • 不,真的没有。您确定 '\t' 是您用来打开结果文件的正确分隔符吗?
  • 你是对的,删除 '\t' 解决了这个问题。非常感谢你:)
【解决方案2】:

您的部分问题是writerow 需要一个可迭代的值。你给它一个字符串(', '.join 的输出),所以字符串中的每个字母都被写入文件中一个单独的分隔字段。如果您将bi 直接传递给 writerow,它至少应该可以解决该特定问题。

【讨论】:

  • 确实如此,但会写入两个单独的列表。我添加了 bi 以删除括号。可能不是最好的方法!
  • 使用bi 来展平两个列表的元组应该没问题,如果过于复杂的话。有更简单的方法,比如建筑怪胎的答案使用。
猜你喜欢
  • 2015-01-22
  • 2021-11-30
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 2021-12-17
相关资源
最近更新 更多