【发布时间】:2019-05-04 03:57:52
【问题描述】:
我想通过 bash 查找 csv 文件中的重复项,并使用管道作为字段分隔符。
举个例子:
输入:
W14|E75
Z20|K60
R59|R59
K60|O74
A08|M10
预期输出:
Z20|K60
R59|R59
K60|O74
其他预期输出:
Z20|K60
R59|R59
我的意思是当表达式已经存在于第一列时,只需保留它,与第二列相同,否则我可以接受只保留第一行。
我尝试的是:
awk -F "|" 'FNR==NR { x[$1,$2]++; next } x[$1,$2] > 1' file.csv file.csv
我考虑使用 grep,但我不确定该怎么做。
抱歉英语不好,提前谢谢你
【问题讨论】:
-
“表达”和“保留它”是什么意思?为了让您的问题更清楚,请首先仅描述您的理想解决方案是什么样的,然后单独描述您愿意做出的妥协。像现在这样,太混乱了。
-
是的 - W14 或 E75 有什么重复的地方?
-
完全不清楚您的示例中的“重复”是什么意思。请澄清!