【发布时间】:2020-01-29 21:23:10
【问题描述】:
你好
我有一个序列,例如:
record_dict = SeqIO.to_dict(SeqIO.parse("sequence.fasta", "fasta"))
>sequence1
AAACCCGGGTTTAAACCCGGGTTTGGGTTTGGG
我从这个序列中知道如何选择具有坐标的特定部分:
print(record_dict[sequence1].seq[coordinate_start:coordinate_end])
print(record_dict[sequence1].seq[3:7])
我得到:
CCCGG
但是如果我想从
中删除这部分>sequence1
AAACCCGGGTTTAAACCCGGGTTTGGGTTTGGG
得到
>sequence1
AAACGTTTAAACCCGGGTTTGGGTTTGGG
有人有想法吗?
感谢您的帮助
这里有一个更好的例子
ACCGCTTTGAATCCGAGCTAG
---- ----
我想删除 2 个部分:
TCCG和GCTA对应的坐标
11:14 和 16:19
最后我想删除两者并得到:
>seq
ACCGCTTTGAAAG
【问题讨论】:
-
仅供参考,您的示例是错误的。如果删除 CCCGG,第四个字母就不会是 C
标签: python bioinformatics biopython fasta