【发布时间】:2019-05-27 07:37:36
【问题描述】:
我正在尝试根据用户浏览历史(标记为 user_id 的 URL)训练 doc2vec。我使用chainer深度学习框架。
有超过 2000 万个嵌入(user_id 和 url)需要初始化,这些嵌入不适合 GPU 内部存储器(最大可用 12 GB)。 CPU 上的训练非常慢。
我正在尝试使用这里给出的 chainer 编写的代码 https://github.com/monthly-hack/chainer-doc2vec
如果有的话,请建议尝试的选项。
【问题讨论】:
-
你自己发现了什么
options to try(然后解雇了?)?
标签: deep-learning nlp word-embedding chainer