【发布时间】:2017-04-18 04:23:41
【问题描述】:
我在 TensorFlow 中基于 char-rnn-tensorflow 松散地构建了一个下一个字符预测器神经网络。结果,我成功地计算了给定测试序列的下一个字符的概率分布。
取所有log 概率的平均值,我可以成功获得“字符级别的困惑”。我几乎使用了pull request 中的代码来实现这一点。
但是,我需要转到“单词级别的困惑”,因为我需要将我的模型与标准结果进行比较,其中大多数报告基于“单词级别的困惑”的语言模型的有效性。 (维基百科描述了单词级别的困惑here)
这样做的正确方法是什么?有没有可能?
【问题讨论】:
标签: python nlp tensorflow