【发布时间】:2018-06-02 14:10:37
【问题描述】:
使用 Python 3.5、NLTK 和 WordNet(最新版本),我正在计算单词“continuous”和“ongoing”的所有同义词集对之间的 wup_similarity()。每个距离都是“无”,即使这两个词的简单英语含义看起来确实相似。我还注意到这些词的词性分别是“形容词”和“形容词卫星”。
是不是词性不同导致计算失败? 有没有办法以某种方式结合这两个词性来规避这个问题?
非常感谢您。我的代码 sn-p 如下所示。
import nltk
from nltk.corpus import wordnet as wn
sl1 = wn.synsets("continuous")
sl2 = wn.synsets("ongoing")
for x in sl1:
for y in sl2:
print(x, y, x.wup_similarity(y))
【问题讨论】: