【发布时间】:2011-12-07 15:13:38
【问题描述】:
我正在尝试从文件中提取一些 DNA 信息。
在由碱基 GCAT 组成的 DNA 数据之前,有一个词 ORIGIN,在之后有一个 //。如何编写正则表达式来获取这些标记之间的这些碱基?
我尝试了以下方法,但它不起作用。
[ORIGIN(GCATgcat)////]
样本数据:
ORIGIN
1 acagatgaag acagatgaag acagatgaag acagatgaag
2 acagatgaag acagatgaag acagatgaag acagatgaag
//
【问题讨论】:
-
您能否提供一个输入字符串和预期的输出。
-
刚刚做到了 :) 从我正在读取的文件中添加了一个示例
-
请不要使用正则表达式来解析生命形式 :)
-
啊啊,这是一个全新的水平!
标签: java regex dna-sequence