【发布时间】:2019-09-24 14:42:13
【问题描述】:
我正在尝试建立一个 dataframe 的 word 和 fuzzywuzzy 分数,并获得前 5 名。
例如我有测试词test = "kuku"
我的词袋是:
words = ["tutu", "pupu", "lulu", "kuko", "dfvfd", "wwwer"]
到目前为止,我已经完成了以下工作:
import os
import pandas as pd
from fuzzywuzzy import fuzz
test = "kuku"
[print(i, fuzz.ratio(i, test)) for i in words]
但我希望能够按分数排序并获得前 N 个。
请告知解决此类问题的最佳做法是什么?
【问题讨论】:
-
fuzzywuzzy库中有特定的函数,例如process.extractBests,可以满足您的需求。 -
@Andy 请举个例子
-
from fuzzywuzzy import process;process.extractBests(test, words, limit=N)
标签: python pandas fuzzy-comparison