【发布时间】:2021-07-04 02:24:39
【问题描述】:
我有一个文本文件,其中每条记录都以 no 和 name 开头,并以空行结尾。我想在一行中将每条记录作为逗号分隔值。我尝试了以下代码,其代码文件和文本文件链接附在下面: biosample.txt sark.awk
unix命令:运行代码是:
gawk -f sark.awk biosample.txt
然后运行:
sed 's/,,/\n/g' <biosample.txt > out.txt
但out.txt 有点不一致/混乱/混乱。
我希望每条记录在一行中,只为以下标题提取值:
record name
Identifiers
Organism
strain
isolate
serovar
isolation source
collected by
collection date
geographic location
host
host disease
Accession
ID
potential_contaminant
sample type
Description
从每条记录中选取每个标题的值,并用新行分隔。
谢谢
【问题讨论】:
-
您能否发布输入文件的摘录以及输出文件的外观?
-
请edit您的问题,并在您的问题中直接显示代码和一个小输入文件,格式为代码块。 “discrepant/messy/confusing” 不是一个充分的问题描述。显示实际输出和预期输出,并在必要时解释实际输出错误的原因。
-
@user3506020 -
sark.awk的缩进很荒谬。 -
gawk输入和sed输入(后者必须是gawk输出)怎么可能同名biosample.txt? -
我已将我的文件和代码附在可下载的帖子中。