【发布时间】:2017-06-03 09:35:27
【问题描述】:
是否可以使用 tfidf(Python 中的 tfidfvectorizer)来确定在尝试区分 两个文本类别(即正面或负面情绪等)时哪些词最重要?例如,哪些词对于识别正类最重要,然后分别哪些词对于识别负类最有用?
【问题讨论】:
-
您熟悉 PCA(主成分分析)吗?这就是你需要的想法,它将把你从典型的 BoW 或句子向量范式中拉出来,但应该会给你带来好的结果。
标签: machine-learning nlp text-mining