最好在建议算法之前了解更多有关数据的信息,但我们假设单词在单一情况下是英文的。
让我们为每个字母分配一个从 2 到 101 的素数。对于每个单词,我们可以通过将其字母对应的数字相乘来计算它的“字谜数字”。
让我们声明一个 {number, list} 对的字典。以及一个用于收集结果字谜的列表。
那么我们可以分两步收集字谜:简单地遍历文件,将每个单词根据其“字谜编号”放入字典列表中;遍历地图,对于长度超过 1 的每个对列表,将其内容存储在一个大字谜列表中。
更新:
import operator
words = ["thore", "ganamar", "notanagram", "anagram", "other"]
letter_code = {'a':2, 'b':3, 'c':5, 'd':7, 'e':11, 'f':13, 'g':17, 'h':19, 'i':23, 'j':29, 'k':31, 'l':37, 'm':41, 'n':43,
'o':47, 'p':53, 'q':59, 'r':61, 's':67, 't':71, 'u':73, 'v':79, 'w':83, 'x':89, 'y':97, 'z':101}
def evaluate(word):
return reduce( operator.mul, [letter_code[letter] for letter in word] )
anagram_map = {}
anagram_list = []
for word in words:
anagram_number = evaluate(word)
if anagram_number in anagram_map:
anagram_map[ anagram_number ] += [word]
else:
anagram_map[ anagram_number ] = [word]
if len(anagram_map[ anagram_number ]) == 2:
anagram_list += anagram_map[ anagram_number ]
elif len(anagram_map[ anagram_number ]) > 2:
anagram_list += [ word ]
print anagram_list
当然可以进一步优化实现。例如,您实际上并不需要字谜图,只需一个计数器就可以了。但我想代码最能说明这个想法。