【发布时间】:2014-10-26 20:12:46
【问题描述】:
我有分隔文件。(CSV/PIPE 分隔文件)
示例文件:
Id,Name,Age
1,ads,23
2,dfg,24
2,hgh,25
3,fgh,26
4,fdfgh,27
4,fh,28
我必须在 Id 列上获取 重复计数,并且还应该创建单独的文件(重复)。应创建重复计数和包含重复的文件。
输出应该是这样的
控制台:应该像这样打印
ID :
2 is repeated 2 times
4 is repeated 2 times
输出文件应该看起来像
ID:
2 is repeated 2 times
4 is repeated 2 times
这是我的示例代码。
import sys
import csv
import datetime
import time
import os from operator
import itemgetter from collections
import Counter
d = ','
read1 = csv.reader(open('D:\ANACONDS\example.csv','r'),delimiter=d)
sort_src = sorted(read1, key=itemgetter(0))
g = len(list(csv.reader(open('D:\ANACONDS\example.csv'))))
print("the number of records are :" ,g)
ids = Counter()
for row in sort_src:
ids += Counter([row[0]])
print(len(list(ids)))
任何帮助将不胜感激。
【问题讨论】:
-
缩进在 Python 中很重要 - 请修正您问题中的代码格式。此外,请提供您从代码中获得的示例输入的实际输出,以便可以将其与您想要的输出进行比较。
标签: csv python-3.x duplicates