【发布时间】:2021-05-18 08:30:34
【问题描述】:
我有一个常用词和几个句子的列表。
我需要检查哪个句子有更多常用词。
我有一个函数可以计算给定句子中常用词的总数,我可以用它来比较不同句子的计数:
def get_words_count_in_sentence(text, words_list):
cnt = 0
for word in words:
cnt += text.lower().count(word.lower())
return cnt
但问题是我还需要考虑句子包含的列表中有多少不同词。
例如:如果第一个句子包含 10 次列表的第一个单词,第二个句子包含 1 次列表的第一个单词,2 次第二个单词,1 次第三个单词,那么第二个句子应该被认为更相似。
如何更新我的代码以实现此优先级?
【问题讨论】: