【发布时间】:2017-05-07 21:18:23
【问题描述】:
我有一个文件 input.txt,在 bash 中使用 sed、awk 或 shell 脚本,我怎样才能得到一个列中唯一不同的字符串?
例如:
# cat input.txt
878933fa4965c31c88ee8696a1a5838f abc xyz
878933fa4965c31c88ee8696a1a5838f abc xyz
878933fa4965c31c88ee8696a1a5838f abc xyz
878933fa4965c31c88ee8696a1a5838f abc xyz
878933fa4965c31c88ee8696a1a5838f abc xyz
878933fa4965c31c88ee8696a1a5838f abc xyz
878933fa4965c31c88ee8696a1axxxxx abc xyz
878933fa4965c31c88ee8696a1a5838f abc xyz
878933fa4965c31c88ee8696a1a5838f abc xyz
878933fayyyyyy1c88ee8696a1a5838f abc xyz
878933fa4965c31c88ee8696a1a5838f abc xyz
878933fa4965c31c88ee8696a1a5838f abc xyz
我只想选择并显示“878933fa4965c31c88ee8696a1axxxxx”和“878933fayyyyyy1c88ee8696a1a5838f”
【问题讨论】:
-
澄清为什么这将是预期的输出,特别说明为什么
878933fa4965c31c88ee8696a1a5838f不包含在输出中。 -
它是一个文件的 md5sum 编码。如果一个或两个文件代码与总计 15 个左右不同,我想选择一个文件的 md5sum。或者找出不同步的文件。
-
谢谢大家的回复。