【发布时间】:2021-09-21 18:56:57
【问题描述】:
我训练并保存了一个 word2Vec 模型“myWord2Vec.model”以将其传递给逻辑回归模型进行训练,但向量大小大于我的训练数据集,因此我需要减小向量大小。我尝试了以下代码:
model = gensim.models.KeyedVectors.load_word2vec_format('myWord2Vec.model', limit=2021)
它给了我这个错误:
UnicodeDecodeError: 'utf-8' codec can't decode byte 0x80 in position 0: invalid start byte
我不知道如何修复它,也不知道如何减小矢量大小。 我将不胜感激!
【问题讨论】:
标签: python-3.x utf-8 gensim word2vec