【发布时间】:2022-08-05 23:01:38
【问题描述】:
我想找一些数据平台或程序库来启用模糊评估/计算。我发现scikit-fuzzy 可能有用。但是我找不到一致的模糊矩阵函数。我想找到模糊一致矩阵的原因是来自一篇论文https://www.tandfonline.com/doi/full/10.1080/00207543.2013.869369。他们从
至
我假设会有一些数据平台或python代码可以自动实现这一点,有人可以帮助我吗?
标签: python fuzzywuzzy
我想找一些数据平台或程序库来启用模糊评估/计算。我发现scikit-fuzzy 可能有用。但是我找不到一致的模糊矩阵函数。我想找到模糊一致矩阵的原因是来自一篇论文https://www.tandfonline.com/doi/full/10.1080/00207543.2013.869369。他们从
至
我假设会有一些数据平台或python代码可以自动实现这一点,有人可以帮助我吗?
标签: python fuzzywuzzy
我使用的代码是 RapidFuzz 包的一部分,它也计算字符串相似度。这是一个可能有用的链接:
https://maxbachmann.github.io/RapidFuzz/Usage/process.html
当我将一列字符串与自身进行比较时,我用来生成矩阵的代码是这样的:
strings1= df['usernames']
C = process.cdist(strings1, strings1, scorer=fuzz.ratio, workers = -1
输出:
array([[100. , 22.222221, 19.047619, ..., 21.052631, 26.666666,
11.764706],
[ 22.222221, 100. , 21.052631, ..., 23.529411, 15.384615,
13.333333],
[ 19.047619, 21.052631, 100. , ..., 30. , 12.5 ,
22.222221],
...,
[ 21.052631, 23.529411, 30. , ..., 100. , 14.285714,
25. ],
[ 26.666666, 15.384615, 12.5 , ..., 14.285714, 100. ,
33.333332],
[ 11.764706, 13.333333, 22.222221, ..., 25. , 33.333332,
100. ]], dtype=float32)
这也比使用 Fuzzy Wuzzy 快得多,因为 RapidFuzz 是用 C 语言开发的。希望这会有所帮助
【讨论】: