【发布时间】:2020-09-05 04:12:37
【问题描述】:
SpaCy 中的每个单词都由长度为 300 的向量表示。如何将这些单词绘制在散点图上,以直观地了解任意 2 个单词的接近程度?
【问题讨论】:
标签: matplotlib machine-learning nlp spacy word-embedding
SpaCy 中的每个单词都由长度为 300 的向量表示。如何将这些单词绘制在散点图上,以直观地了解任意 2 个单词的接近程度?
【问题讨论】:
标签: matplotlib machine-learning nlp spacy word-embedding
在处理中小型文本时,ScatterText 是一种工具,可用于发现具有显着特征的单词。它还使用户能够创建包含非重叠术语标签的交互式散点图。
通过 -https://pypi.org/project/scattertext/ 安装
import spacy
import scattertext as st
nlp = spacy.load('en')
corpus = st.CorpusFromPandas(convention_df,
category_col='party',
text_col='text',
nlp=nlp).build()
【讨论】:
有一个名为 whatlies 的新包正是这样做的:https://rasahq.github.io/whatlies/
【讨论】: