【问题标题】:Show data only from one cluster仅显示来自一个集群的数据
【发布时间】:2019-05-14 20:32:59
【问题描述】:

我有一个熊猫数据框。

input_data = {'col1': [1, 2, 3], 'col2': [3, 4, 5]}
d = pd.DataFrame(data=input_data)

anotherdata= magic(d)
df = pd.DataFrame(data=anotherdata)

我使用 DBSCAN 来集群 df。 结果我有cluster_labels。在这种情况下,标签的值可以从 -1(离群值)到 2。

我希望有机会单独显示来自特定类的数据,并可以通过索引访问初始数据帧d

例如,我在input_data 中有一个索引为 1 的元素。 该元素被分配到簇 0,簇 0 中没有其他元素。

如何通过索引在input_data 中找到这个元素?

【问题讨论】:

  • 您的示例无法运行,因为未定义 PCA,请注意
  • 从你所问的看起来你想要d.loc[1,:]
  • sklearn的那个吗?
  • 其实PCA不计,我只是编辑了问题

标签: python arrays pandas dataframe dbscan


【解决方案1】:

你可能想要使用

d[cluster_labels == 0]

除非您的 magic 函数更改了索引。

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 2016-10-11
    • 1970-01-01
    • 1970-01-01
    • 2022-12-03
    • 2012-08-24
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多