【发布时间】:2019-03-01 03:21:36
【问题描述】:
我将第一次使用朴素贝叶斯进行文本分类。 我在http://scikit-learn.org/stable/tutorial/text_analytics/working_with_text_data.html 上找到的这段代码:
>>> from sklearn.naive_bayes import MultinomialNB
>>> clf = MultinomialNB().fit(X_train_tfidf, twenty_train.target)
我想解决一个关于传递给函数fit()的参数X_train_tfidf、twenty_train.target的疑问。
X_train_tfidf 是训练集中所有文档的 tfidf 向量表示。
twenty_train.target 是文档在 X_train_tfidf 集中出现的确切顺序的对应标签。
我说的对吗?
【问题讨论】:
标签: scikit-learn text-classification naivebayes