【发布时间】:2016-03-11 15:14:53
【问题描述】:
我有一个名为 protein 的字符串。它打印出这样的内容:KALSKJKDALIEUTSTARTALKSJDALK*KAJSLDKJSTARTJAISOIEWORUNCD*
我想要一个代码,可以在此字符串中搜索 START 和 * 并打印它们之间的字符,在本例中为字母。
例如:protein = STARTJSADHFJAS*KJSTARTAKSLJDIOQWIE*
print protein_filtered = [JSADHFJAS, AKSLJDIOQWIE]
到目前为止,我有这个,但这只会让我得到第一个蛋白质序列。另外,我不在乎它是附加到列表还是字符串。
start_marker = 'START'
end_marker = '*'
start = protein.index(start_marker) + len(start_marker)
end = protein.index(end_marker, start + 1)
print protein[start:end]
【问题讨论】:
标签: python regex python-2.7