【发布时间】:2015-04-15 03:57:02
【问题描述】:
我有一个 pandas 数据框,其中包含一系列文档的字数。我可以对其应用sklearn.feature_extraction.text.TfidfVectorizer 以返回术语文档矩阵吗?
import pandas as pd
a = [1,2,3,4]
b = [1,3,4,6]
c = [3,4,6,1]
df = pd.DataFrame([a,b,c])
如何在 df 中获取 tfidf 版本的计数?
【问题讨论】:
标签: python nlp scikit-learn tf-idf