【发布时间】:2016-06-16 10:32:25
【问题描述】:
如何测量两个字符串序列之间的相似度百分比?
我有两个文本文件,文件中的序列写成这样
第一个文件:
AAA BBB DDD CCC GGG MMM AAA MMM
第二个文件:
BBB DDD CCC MMM AAA MMM
如何根据字符串的顺序来衡量这两个文件之间的相似度?
例如,在上面的示例中,由于字符串的顺序相同,两个文件具有相似性,但是 file-2 中缺少一些字符串。什么算法最适合解决这个问题,这样我就可以测量字符串的顺序而不是字符串的频率有多相似?
【问题讨论】:
标签: sequences