【发布时间】:2019-07-29 08:14:54
【问题描述】:
我有一个几乎没有分类和数字特征的数据框。为此,我将我的 BoW(CountVectorizer) 文本列连接起来,产生了超过 56,000 个特征。所以我正在考虑做 PCA 来减少功能的数量。
我认为在这里选择正确数量的主成分至关重要,但我对这里要考虑多少 n_components 感到困惑?
【问题讨论】:
-
好问题!
标签: machine-learning nlp pca svd