【问题标题】:What is the difference between the different GloVe models? [closed]不同的 GloVe 型号有什么区别? [关闭]
【发布时间】:2018-07-28 13:40:35
【问题描述】:
【问题讨论】:
标签:
nlp
deep-learning
stanford-nlp
【解决方案1】:
很遗憾,我认为没有人能给出比这更好的答案了:
“尝试几种选择,看看哪一种效果最好”
我见过使用 Wikipedia 2014 + Gigaword 100d 向量产生 SOTA 结果以进行阅读理解的工作。如果没有实验,很难确定哪个语料库更接近您的音乐评论集,或者更大维度的词嵌入会产生什么影响。
这只是随机建议,但我想我建议按以下顺序尝试:
100d 来自 Wikipedia+Gigaword
300d 来自 Wikipedia+Gigaword
普通爬行300天
您不妨在制作原型时从较小维度的嵌入开始,然后您可以尝试使用较大的嵌入,看看是否能提高性能。
本着促进其他小组工作的精神,我肯定会说你应该看看 AllenNLP 的这些 ELMo 向量:
http://allennlp.org/elmo
他们看起来很有前途!
【讨论】:
-
非常感谢!这是我的假设,但我想知道使用这些语料库是否有实际原因。例如,也许研究人员已经想到了哪种类型的数据集最适合它。我将看看 ELMo 向量。顺便说一句,斯坦福大学的研究人员是否尝试过使用强化学习?类似于 Metamind 所做的 einstein.ai/research/…
-