【发布时间】:2018-09-27 09:13:52
【问题描述】:
我正在尝试使用 Spacy 库进行句子相似性,我想了解它是如何工作的!?
他们的文档不清楚:
默认情况下,spaCy 使用平均向量算法,使用 预训练的向量(如果可用)(例如 en_core_web_lg 模型)。如果 不是,使用 doc.tensor 属性,该属性由 标记器、解析器和实体识别器。这就是 en_core_web_sm 的方式 模型提供了相似之处。通常基于 .tensor 的相似性 将更具结构性,而词向量相似性将是 更具话题性。您还可以自定义 .similarity() 方法,以 提供您自己的相似度函数,可以使用 监督技术。
我发现这个问题:How does the .similiarity method works? 说它使用词嵌入,但在我的实现中我没有“en_core_web_lg 模型”,但我有 en_core_web_sm,所以通过这种方式,“标记器”如何计算相似度、解析器和实体识别器”?
【问题讨论】:
标签: python similarity spacy