【发布时间】:2017-10-19 15:00:08
【问题描述】:
我正在使用来自 https://github.com/tensorflow/tensorflow/blob/r1.2/tensorflow/examples/tutorials/word2vec/word2vec_basic.py 的 word2vec_basic,我有几个(一般)问题。
我应该如何确定num_steps?在示例中,它设置为 100001。
skip_window 是 5 就足够了,还是应该更大 (10, 25)?
此外,是否应从训练数据集中删除停用词和标点符号,是否应将所有单词转换为小写?
谢谢。
【问题讨论】:
标签: tensorflow word2vec word-embedding