【问题标题】:Fuzzy calculation, data platform or library模糊计算、数据平台或库
【发布时间】:2022-08-05 23:01:38
【问题描述】:

我想找一些数据平台或程序库来启用模糊评估/计算。我发现scikit-fuzzy 可能有用。但是我找不到一致的模糊矩阵函数。我想找到模糊一致矩阵的原因是来自一篇论文https://www.tandfonline.com/doi/full/10.1080/00207543.2013.869369。他们从

我假设会有一些数据平台或python代码可以自动实现这一点,有人可以帮助我吗?

    标签: python fuzzywuzzy


    【解决方案1】:

    我使用的代码是 RapidFuzz 包的一部分,它也计算字符串相似度。这是一个可能有用的链接:

    https://maxbachmann.github.io/RapidFuzz/Usage/process.html

    当我将一列字符串与自身进行比较时,我用来生成矩阵的代码是这样的:

    strings1= df['usernames']
    C = process.cdist(strings1, strings1, scorer=fuzz.ratio, workers = -1
    
    

    输出:

    array([[100.      ,  22.222221,  19.047619, ...,  21.052631,  26.666666,
             11.764706],
           [ 22.222221, 100.      ,  21.052631, ...,  23.529411,  15.384615,
             13.333333],
           [ 19.047619,  21.052631, 100.      , ...,  30.      ,  12.5     ,
             22.222221],
           ...,
           [ 21.052631,  23.529411,  30.      , ..., 100.      ,  14.285714,
             25.      ],
           [ 26.666666,  15.384615,  12.5     , ...,  14.285714, 100.      ,
             33.333332],
           [ 11.764706,  13.333333,  22.222221, ...,  25.      ,  33.333332,
            100.      ]], dtype=float32)
    

    这也比使用 Fuzzy Wuzzy 快得多,因为 RapidFuzz 是用 C 语言开发的。希望这会有所帮助

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2013-12-28
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多