【发布时间】:2019-03-18 21:53:17
【问题描述】:
我想在我的机器学习模型中使用预训练的词嵌入。我拥有的词嵌入文件大约是 4GB。我目前将整个文件读入字典中的内存,每当我想将一个单词映射到它的向量表示时,我都会在该字典中进行查找。
内存使用率非常高,我想知道是否有另一种使用词嵌入的方法,而无需将整个数据加载到内存中。
我最近遇到了 Python 中的生成器。他们能帮我减少内存使用吗?
谢谢!
【问题讨论】:
标签: python machine-learning memory-management nlp word-embedding