【发布时间】:2015-02-08 09:57:45
【问题描述】:
我想删除包含三列的 txt 文件中的重复项。重复项是具有相同“id”和“descr”的那个,我只需要保留最低值。
id1 descr1 0.9
id1 descr1 1.23
id1 descr1 0.3
id1 descr2 0.5
id2 descr2 23.1
id3 descr3 1.2
id3 descr3 14.3
id3 descr3 0.5
id3 descr3 0.34
id3 descr4 4.5
所以,我想收到以下内容
id1 descr1 0.3
id1 descr2 0.5
id2 descr2 23.1
id3 descr3 0.34
id3 descr4 4.5
现在,我有以下技巧
sort -k1,1 -k2,2 -k3,3n file.txt
以及如何取field1+field2的第一次出现?
【问题讨论】:
标签: text awk duplicates