【发布时间】:2017-09-06 15:49:32
【问题描述】:
我有一个词,让我们说“美国”,还有一个文本文件。我想知道整个文件是否是关于“美国”的。 “美国”这个词在文件中可能会被提及 100 或 1000 次,但到最后,文件可能会谈到中国。
我浏览了 Python 中的情绪分析库,但只有当文档以正面、负面或中立的方式提及该词时,这些库才会返回。
我还可以计算单词被提及的次数,以及单词与文档中每个单词之间的相似度,但仍然不知道如何判断整个文档是否与提到的单词有关。
python 中是否有任何库可以执行此操作,或者任何 API?
【问题讨论】:
-
在这里查看主题建模:textacy.readthedocs.io/en/latest
-
@MedAli 谢谢,我去看看。
-
我认为此链接中给出的代码可能会派上用场。使用此代码对一个句子中具有最多词频的文本进行总结。 github.com/assafelovic/nlp_url_summarizer
标签: python python-2.7 python-3.x text sentiment-analysis