【问题标题】:How to input distance matrix in SPSS to do Twostep cluster analysis?如何在SPSS中输入距离矩阵进行两步聚类分析?
【发布时间】:2016-09-22 01:14:42
【问题描述】:

我已经有一个距离矩阵(1609*1609),每个距离都在0~1之间。我想通过在 SPSS 中使用 Twostep 聚类将 1609 个项目聚类到自然组中。我想使用距离矩阵作为两步聚类分析的输入。如何修改语法来做到这一点?还是我做不到?

DATASET ACTIVATE dataname1.
TWOSTEP CLUSTER
  /CATEGORICAL VARIABLES=ROWTYPE VARNAME
  /CONTINUOUS VARIABLES=A1 to A1609 *Ignore the A2 to A1608 here.
  /DISTANCE LIKELIHOOD
  /NUMCLUSTERS AUTO 15 BIC
  /HANDLENOISE 0
  /MEMALLOCATE 64
  /CRITERIA INITHRESHOLD(0) MXBRANCH(8) MXLEVEL(3)
  /VIEWMODEL DISPLAY=YES
  /SAVE VARIABLE=TSC_4920.

提前致谢。

【问题讨论】:

    标签: matrix cluster-analysis distance spss


    【解决方案1】:

    根据我对模糊记录的“双步”聚类的理解,它需要计算点的平均值。

    那么它不能与距离矩阵一起使用。考虑改用 ELKI、sklearn 或 R。另外,它们是开源的,因此您实际上可以检查它们在做什么,并自定义它们,例如他们不允许在某处使用距离矩阵。这是一个非常大的特性,是开源的。

    【讨论】:

    • 感谢您的信息。事实上,我已经在 R 中尝试过Nbclust,但似乎使用不同的方法(不是 AIC 或 BIC)来确定簇数。
    【解决方案2】:

    两步算法以及统计中的所有其他算法都在帮助菜单中的算法手册中有完整的记录。

    【讨论】:

    • 抱歉,我只解决了关于算法的问题。 TWOSTEP 不提供从现有距离矩阵开始。用于层次聚类的 CLUSTER 过程确实接受矩阵输入。
    • 别抱歉。这是一个很好的建议。我已经让 SPSS 读取矩阵输入来进行层次聚类,但我不能在 TwoStep 聚类分析中做同样的事情。再次感谢您的回复。
    猜你喜欢
    • 2011-04-13
    • 2014-07-09
    • 2020-01-23
    • 2017-04-13
    • 2015-04-21
    • 2021-05-07
    • 1970-01-01
    • 2016-03-20
    • 1970-01-01
    相关资源
    最近更新 更多