【发布时间】:2021-09-29 15:50:56
【问题描述】:
我有两个值,它们的顺序不匹配,并且值在理想情况下是相同的。
当我计算字符串相似度时,它们之间的分数与理想分数相差甚远
col_1 = c("USA,UK,APAC")
col_2 = c("UK,APAC,USA")
library(stringdist)
stringdist(col_1,col_2, method = 'jw')
如何识别 col_1 和 col_2 相似,即使它们的顺序排列错误。即有没有任何方法可以识别两个值在理想情况下是相同的
【问题讨论】:
标签: r dplyr stringdist