【问题标题】:Loading labels and data from csv into sklearn将标签和数据从 csv 加载到 sklearn
【发布时间】:2023-03-03 08:04:25
【问题描述】:

我有一个 csv 文件,其中包含几行分类/标签,后跟与之相关的数据:

  cat, 0, 1, 45, 23, ...
  dog, 1, 5, 75, 23, ...
  cat, 3, 4, 63, 24, ...
  cat, 0, 1, 44, 23, ...
  dog, 7, 3, 25, 4, ...

如何将 csv 文件加载到 sklearn 中?

编辑:还是我需要用数字等价物替换标签? IE。狗 = 1,猫 = 2,等等。

【问题讨论】:

    标签: python python-2.7 scikit-learn


    【解决方案1】:

    * 根据 Vivek 的评论编辑

    你可以使用熊猫。这是将数据输入简单随机森林分类器的示例:

    import pandas as pd
    from sklearn.ensemble import RandomForestClassifier
    
    data = pd.read_csv('/path/to/data')
    
    Y = data[[0]]  # labels
    X = data.drop([0], axis = 1)  # features
    
    clf = RandomForestClassifier()
    clf.fit(X, Y)
    

    【讨论】:

    • 标签(目标)被 scikit-learn 接受,它会自动处理转换,所以不需要在那里做任何事情。
    猜你喜欢
    • 1970-01-01
    • 2013-02-13
    • 1970-01-01
    • 2018-07-11
    • 1970-01-01
    • 1970-01-01
    • 2021-09-13
    • 2015-07-18
    • 2023-03-17
    相关资源
    最近更新 更多