【发布时间】:2020-04-16 07:11:24
【问题描述】:
在我使用向量作为循环神经网络的输入之后,我正在使用 spacy 将句子中的每个单词替换为数字/代码。
import spacy
str="basing based base"
sp = spacy.load('en_core_web_sm')
sentence=sp(str)
for w in sentence:
print(w.text,w.lemma)
在使用 keras 的神经网络的第一层,即嵌入层,我必须知道查找表中的最大单词数,有人知道这个数字吗? 谢谢
【问题讨论】:
-
如何获得整数索引,用于从层获取嵌入?是 spacy 的内部 ID 吗?
标签: python keras neural-network spacy lemmatization