【发布时间】:2019-03-02 21:10:02
【问题描述】:
我正在开发一个 python 项目,该项目读取一个 URL 编码的重叠字符串列表。每个字符串的长度为 15 个字符,并与其顺序字符串重叠至少 3 个字符,最多 15 个字符(相同)。
该程序的目标是从重叠字符串列表(有序或无序)转换为压缩的 URL 编码字符串。
我当前的方法在重叠字符串中的重复段处失败。例如,我的程序组合错误:
StrList1 = [ 'd+%7B%0A++++public+', 'public+static+v','program%0Apublic+', 'ublic+class+Hel', 'lass+HelloWorld', 'elloWorld+%7B%0A+++', '%2F%2F+Sample+progr', 'program%0Apublic+']
输出:
output = ['ublic+class+HelloWorld+%7B%0A++++public+', '%2F%2F+Sample+program%0Apublic+static+v`]
当正确的输出是:
output = ['%2F%2F+Sample+program%0Apublic+class+HelloWorld+%7B%0A++++public+static+v']
我使用的是简单的 python,而不是 biopython 或序列比对器,但也许我应该使用?
非常感谢任何关于此事的建议或在 python 中执行此操作的好方法的建议!
谢谢!
【问题讨论】:
标签: python string merge string-comparison sequence-alignment