【发布时间】:2020-02-20 02:28:05
【问题描述】:
我正在对 Ecoli 数据集进行分类作为作业 数据集是从 UCI 存储库中收集的。要创建决策树分类器,我需要将对象数据类型转换为浮点数。将数据类型转换为浮点数时,但列中的字符串全部更改为“NaN” 这样我就不能在 fit() 函数中使用该列
data_file = pd.read_csv('/home/root-user/Documents/ecoli.csv')
df1 = pd.DataFrame(data_file)
df1_cleaned = df1.drop('SEQUENCE_NAME',axis=1)
df1_cleaned['PROTEIN_SEQUENCE'] = pd.to_numeric(df1_cleaned['PROTEIN_SEQUENCE'], errors='coerce')
cleaned_list = df1_cleaned.values.tolist()
print(df1_cleaned)
那么输出是这样的
【问题讨论】:
标签: python pandas scikit-learn