【发布时间】:2019-06-29 01:25:37
【问题描述】:
我有一个 .txt 文件,其中包含以下行:
Name | Email@example.com | Score
Name2 | Email2@madeupsite.com | Score
其中Score 是一个从 0 到 10 亿的整数。
我想按分数从大到小对这个文件进行排序。我的问题是,由于姓名和电子邮件的长度不同,每次我可以访问它时,分数都不是一致的。我将如何克服这个问题?
(我不太清楚标题的措辞,所以我希望这个机构能更好地解释它;如果问题不清楚,请告诉我)
【问题讨论】:
-
您的输入数据确实是PSV(管道分离值)。您可以使用
pandas.read_csv和sep='|'阅读它。或者只是在每一行上做一个split('|')。然后按第 3 列排序。 -
当你说“没有一致组织的txt输入”时,你实际上只是指“没有固定宽度的字段”。但它仍然有分隔符('|'),你可以分割,所以它确实有一致的组织。