【问题标题】:How to print samples/observations/rows of any one cluster using scikit learn/pandas/python?如何使用 scikit learn/pandas/python 打印任何一个集群的样本/观察/行?
【发布时间】:2017-03-23 21:11:40
【问题描述】:

非常基本的问题:

如何打印归因于任何一个集群的观察结果?

data = pd.read_csv('my_file.csv')
X = data[['Var1','Var2','Var3']]
ms = MeanShift()
ms.fit(X)
labels = ms.labels_
cluster_centers = ms.cluster_centers_

我只想查看任何一个集群的 'Var1'、'Var2'、'Var3' 的值。

【问题讨论】:

    标签: python pandas machine-learning scikit-learn mean-shift


    【解决方案1】:

    听起来您想查看数据集的预测。这可以按如下方式完成:

    y_pred = ms.predict(X)
    

    然后,您可以通过以下操作将这些链接到您的示例:

    df['y_pred'] = y_pred
    

    并根据需要过滤您的数据框,例如查看集群 1 中的样本:

    df[df.y_pred == 1]
    

    【讨论】:

    • 太好了,我想就是这样!
    猜你喜欢
    • 2019-12-31
    • 2018-10-24
    • 2021-05-23
    • 2013-07-21
    • 2017-03-11
    • 1970-01-01
    • 2021-08-25
    • 2016-04-22
    • 2019-12-31
    相关资源
    最近更新 更多