【发布时间】:2020-04-12 14:29:09
【问题描述】:
我是 python 新手,我为此苦苦挣扎了一段时间。 我有一个看起来像这样的文件:
name seq
1 a1 bbb
2 a2 bbc
3 b1 fff
4 b2 fff
5 c1 aaa
6 c2 acg
其中 name 是字符串的名称,seq 是字符串。 我想要一个新列或一个新数据框,指示每两行之间没有重叠的差异数量。例如,我想要名称 [a1-a2] 然后 [b1-b2] 和最后 [c1-c2] 之间的序列之间的差异数。
所以我需要这样的东西:
name seq diff
1 a1 bbb NA
2 a2 bbc 1
3 b1 fff NA
4 b2 fff 0
5 c1 aaa NA
6 c2 acg 2
非常感谢任何帮助
【问题讨论】:
-
您尝试解决什么问题?是否总是两行以相同的字符开头?
-
是的,它们以相同的字母开头,它们之间的唯一区别是末尾的数字。
-
每个字母总是有两个序列吗? @LDT
-
是的,它们按照示例中的指示进行排序
-
嘿@LDT 我认为你有三个正确的解决方案两个你的问题。我倾向于建议您接受 yatu 或 anky 的版本,因为它们更稀疏/更高效,并且还具有更高的灵活性(超过我的)。
标签: python string pandas difference