【问题标题】:What is the difference between the different GloVe models? [closed]不同的 GloVe 型号有什么区别? [关闭]
【发布时间】:2018-07-28 13:40:35
【问题描述】:

https://nlp.stanford.edu/projects/glove/

我正在尝试使用 GloVe 来总结音乐评论,但我想知道哪个版本最适合我的项目。 “glove.840B.300d.zip”会因为它使用更多标记而给我更准确的文本摘要吗?或者也许 Wikipedia 2014 + Gigaword 5 比 Common Crawl 更具代表性?谢谢!

【问题讨论】:

    标签: nlp deep-learning stanford-nlp


    【解决方案1】:

    很遗憾,我认为没有人能给出比这更好的答案了:

    “尝试几种选择,看看哪一种效果最好”

    我见过使用 Wikipedia 2014 + Gigaword 100d 向量产生 SOTA 结果以进行阅读理解的工作。如果没有实验,很难确定哪个语料库更接近您的音乐评论集,或者更大维度的词嵌入会产生什么影响。

    这只是随机建议,但我想我建议按以下顺序尝试:

    100d 来自 Wikipedia+Gigaword 300d 来自 Wikipedia+Gigaword 普通爬行300天

    您不妨在制作原型时从较小维度的嵌入开始,然后您可以尝试使用较大的嵌入,看看是否能提高性能。

    本着促进其他小组工作的精神,我肯定会说你应该看看 AllenNLP 的这些 ELMo 向量:

    http://allennlp.org/elmo

    他们看起来很有前途!

    【讨论】:

    • 非常感谢!这是我的假设,但我想知道使用这些语料库是否有实际原因。例如,也许研究人员已经想到了哪种类型的数据集最适合它。我将看看 ELMo 向量。顺便说一句,斯坦福大学的研究人员是否尝试过使用强化学习?类似于 Metamind 所做的 einstein.ai/research/…
    • 最近的 coref 模型有 RL,但没有总结。
    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2013-06-14
    • 2019-10-28
    • 1970-01-01
    • 2019-09-28
    • 1970-01-01
    相关资源
    最近更新 更多