【发布时间】:2021-07-29 13:10:23
【问题描述】:
这就是我的想象。这是一个示例表:
| Col A | Col B | Similarity |
|---|---|---|
| 5.0 | 5.0 | 1.000 |
| 3.8 | 2.3 | 0.700 |
| 1.3 | 6.7 | 0.300 |
| 2.7 | 8.5 | 0.350 |
| 2.9 | 2.9 | 1.000 |
我应该使用什么算法来做到这一点?
【问题讨论】:
-
我只知道如何通过导入strsim和使用jarowinkler相似度来比较两个字符串。你能通过使用 ipynb 来证明这一点吗?
标签: python pandas dataframe anaconda jupyter