【发布时间】:2014-01-16 20:13:58
【问题描述】:
我有两个文件:
FILE A
12 999900 1
12 999901 1
12 999902 1
12 999903 1
12 999904 1
12 999905 1
12 999906 1
12 999907 1
12 999908 2
12 999909 2
12 999910 2
12 999911 2
12 999912 2
FILE B
#CHROM POS ID REF ALT QUAL FILTER INFO FORMAT Carolyn
12 1000010 . G A 221 . DP=9;VDB=0.0298;AF1=1;AC1=2;DP4=0,0,4,5;MQ=60;FQ=-54 GT:PL:DP:GQ 1/1:254,27,0:9:51
12 1000482 . G A 117 . DP=7;VDB=0.0398;AF1=1;AC1=2;DP4=0,0,1,4;MQ=60;FQ=-42 GT:PL:DP:GQ 1/1:150,15,0:5:27
12 1001152 . T C 127 . DP=10;VDB=0.0392;AF1=1;AC1=2;DP4=0,0,4,6;MQ=58;FQ=-57 GT:PL:DP:GQ
我想编写一个 AWK 脚本,比较文件 A 中的 $2 和文件 B 中的 $2。输出应该与文件 A 类似,但有另一列。如果文件 A 和 B 中的 $2 匹配,则第 4 列应显示“匹配!”。
注意:文件 A 的行数比文件 B 多。
这可能吗??
【问题讨论】:
-
每个文件的第二列是否已排序?
-
是的。但是加入命令不起作用...它会引发错误
-
它抛出:"join: depth_Carolyn.txt:101: is not sorted: 12 1000000 11" 但它已排序.....