【发布时间】:2019-03-01 02:31:12
【问题描述】:
我有以下数据框
df[['row_num','set_id']].head()
row_num path_id_set
988681 [31672, 0]
988680 [31965, 0]
988679 [0, 78464]
我正在尝试使用多标签二值化器,但由于错误代码浮动对象不可迭代而失败
from sklearn.preprocessing import MultiLabelBinarizer
mlb = MultiLabelBinarizer()
mlb.fit_transform(df['set_id'].str.split(','))
TypeError: 'float' object is not iterable
【问题讨论】:
标签: python pandas machine-learning scikit-learn