【发布时间】:2016-05-01 13:46:23
【问题描述】:
我为句子完成实现创建了一个一元语言模型。我有所有单词及其出现次数。
我对如何从这里比较它们感到困惑。我认为我必须计算每个案例的概率并取最大的一个。
所以如果我有 3 个单词可以使用,我比较每个单词的出现次数并取最高的 ?这是正确的实施吗?
或者我将每个单词的出现次数除以训练集的所有(不同?)单词的数量?
谢谢。
【问题讨论】:
标签: python nlp n-gram sentence sentence-similarity