【发布时间】:2021-01-18 09:30:48
【问题描述】:
我一直在学习一个教程,试图理解机器学习,同时尝试他在做什么。
我的数组是:
0 44 72000
2 27 48000
1 30 54000
2 38 61000
1 40 6.377777777777778101
0 35 58000
2 38.77777777777777857 52000
0 48 79000
1 50 83000
0 37 67000
第一列曾经是国家名称,但他使用标签编码器将其转换为 0s、1s 和 2s。
他还想使用 OneHotEncoder 将该列转换为更多功能,但由于他的视频有点过时,他将 categorical_features 与 OneHotEncoder 一起使用,但在我的 sklearn 版本中 OneHotEncoder 已更改,我没有不再有那个参数了。
那么我现在如何在该特定功能上使用 OneHotEncoder?
他尝试的是:
onehotencoder = OneHotEncoder(categorical_features = [0])
X = onehotencoder.fit_transform(X).toarray()
【问题讨论】:
标签: python numpy machine-learning scikit-learn