【发布时间】:2016-05-25 12:50:02
【问题描述】:
我有这个输入文件:
>seq
GATGGATTCGGANNNNNNNNNNNNNNNGTTGTAGGGNNNNNNNNNNNNNNNNNNNNNNGATAGAGAGNN
>suq
AAHAHAH
还有这个命令:
awk '{gsub(/[N]{5,}/,"\n")}1' f.fa
当前输出:
>seq
GATGGATTCGGA
GTTGTAGGG
GATAGAGAGNN
>suq
AAHAHAH
如果找到 5 个或更多连续的 'N'-s,则字符串将被分隔到另一行。问题是我希望输出是这样的:
>seq
GATGGATTCGGA
>seq_1
GTTGTAGGG
>seq_2
GATAGAGAGNN
>suq
AAHAHAH
在每个换行符之前,我想添加 '>' 行,它对应于字符串加上一个递增的数字(为了每个 '>' 行都是唯一的)。我一直在尝试不同的方法,但没有成功。
【问题讨论】:
-
如果必须重复,
suq计数会从 1 还是 3 开始(seq计数停止的地方)?
标签: awk