【问题标题】:Clustering of Variables in pythonpython中的变量聚类
【发布时间】:2016-02-11 16:55:32
【问题描述】:

我有数百个具有二进制值的变量,即 1 和 0,我想看看这些变量如何落入不同的集群?我没有看到任何可应用的 python 方法。但我可以在 R 中看到一个:http://arxiv.org/pdf/1112.0295.pdf

例如,我有变量(特征)a1、a2、a3、a4、.......、a100 的数据。每个 a 都是二进制变量。我不想对观察应用聚类,而是想对 a1,a2,...,a100 应用聚类,并希望查看 a1 落在哪些聚类中或 a2 落在哪些聚类中。

有没有人知道python中类似的包或方法?我尝试在 Anaconda 中应用 R 接口,以便我可以使用 R 方法,但接口不起作用。

Python 3.4.3 |Anaconda 2.3.0(64 位)|

【问题讨论】:

    标签: python-3.x cluster-analysis


    【解决方案1】:

    首先转置您的数据矩阵。

    然后集群特征而不是实例!

    【讨论】:

      【解决方案2】:

      scikit-learn 包正是您想要的。

      它包含很多聚类算法,如K-meansAffinity propagationMean-shiftSpectral clusteringWard hierarchical clusteringAgglomerative clusteringDBSCANGaussian Mixtures等等。

      【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2014-02-18
      • 1970-01-01
      • 1970-01-01
      • 2017-08-28
      • 2019-11-12
      • 2014-12-19
      相关资源
      最近更新 更多