【发布时间】:2021-10-28 12:35:00
【问题描述】:
我是 NLP 和 Doc2Vec 的新手。我注意到一些网站通过洗牌每个时期的训练数据(选项 1)来训练 Doc2Vec,而一些网站使用选项 2。在选项 2 中,没有对训练数据进行洗牌
有什么区别?另外我如何选择最佳的阿尔法?谢谢
### Option 1 ###
for epoch in range(30):
model_dbow.train(utils.shuffle([x for x in tqdm(train_tagged.values)]), total_examples=len(train_tagged.values), epochs=1)
model_dbow.alpha -= 0.002
model_dbow.min_alpha = model_dbow.alpha
对
### Option 2 ###
model_dbow.train(train_tagged.values, total_examples=len(train_tagged.values), epochs=30)
【问题讨论】:
标签: doc2vec