【发布时间】:2020-04-24 07:49:32
【问题描述】:
我正在尝试查看哪些预训练模型包含新闻中的常用短语,我认为 GoogleNews-vectors-negative300.bin 应该是一个全面的模型,但结果它甚至不包括 deep_learning、machine_learning、social_network、社会责任感。什么预训练模型可以包含新闻、公共报道中经常出现的那些词?
import gensim
# Load Google's pre-trained Word2Vec model.
model = gensim.models.KeyedVectors.load_word2vec_format('GoogleNews-vectors-negative300.bin.gz', binary=True)
model.similarity('deep_learning', 'machine_learning')
【问题讨论】:
标签: python nlp gensim word2vec