【发布时间】:2018-02-12 05:30:25
【问题描述】:
我有一长串对象组。每个对象都有简单的属性,例如名称和描述。它们已经与相似的对象分组,但我知道许多组在某种程度上是冗余或重叠的。列表不包含重复的对象,顺序无关紧要。
关于如何根据相似性将它们减少到“n”组的任何建议?谢谢。
字符串的Ie
["apple", "orange", "pear"]
["apple", "steak", "orange"]
["steak", "burger"]
前两个大致上最相似
【问题讨论】:
-
而你如何定义相似?
-
嗨,我通过在列表中拥有相同的对象集来定义它。如果有意义的话,该对象可以被视为一个简单的字符串或数字。
标签: python algorithm statistics probability