【问题标题】:Save Cluster Variables / Variable PSPP保存集群变量/变量 PSPP
【发布时间】:2014-03-14 01:43:36
【问题描述】:

我正在使用 PSPP(不是 SPSS,因为我无法在我的 Ubuntu 机器上运行它),并且我的一组 ~100k 记录与 k-means 集群进行了聚类。现在我真正需要的是更详细的输出,而不是每个集群中有多少记录。我需要保存集群变量,即

第 1 行 => 集群 1

第 2 行 => 簇 4

第 3 行 => 集群 1

等等……

基本上我需要额外的字段来保存每条记录的结果集群亲和力。我目前的语法是:

QUICK CLUSTER  cat1 cat2 cat3 cat4 cat5 cat6 cat7 cat8 cat9 cat10 cat11 cat12
/CRITERIA=CLUSTERS(12) MXITER(100000000).

SPSS 和 PSPP 有很多相同的语法,所以如果 SPSS 中有一个选项,它也可以在这里工作。

【问题讨论】:

    标签: cluster-analysis k-means spss statistics


    【解决方案1】:

    我知道您正在寻找 PSPP 中的内容,但您最好的选择可能是将输出保存为打开的文档,在电子表格中以 .csv 格式打开您的数据文件,然后复制到集群成员中(假设您将 /print=cluster 添加到命令行)。

    【讨论】:

      【解决方案2】:

      PSPP 不处理 /SAVE CLUSTER 子命令。 试试吧!

      QUICK CLUSTER var_list
            [/CRITERIA=CLUSTERS(k) [MXITER(max_iter)] CONVERGE(epsilon) [NOINITIAL]]
            [/MISSING={EXCLUDE,INCLUDE} {LISTWISE, PAIRWISE}]
            [/PRINT={INITIAL} {CLUSTER}]
      

      GNU page of PSPP

      【讨论】:

        【解决方案3】:

        Statistics 应该在 Ubuntu 上运行,但 Statistics QUICK CLUSTER 命令有一个子命令

        /保存集群

        那应该做你想做的事。您可以选择在 CLUSTER 之后的括号中指定变量名称。

        【讨论】:

          猜你喜欢
          • 2018-06-09
          • 2012-07-02
          • 1970-01-01
          • 1970-01-01
          • 2019-05-02
          • 2023-04-06
          • 1970-01-01
          • 1970-01-01
          相关资源
          最近更新 更多