【发布时间】:2013-12-08 09:41:42
【问题描述】:
我想使用 R 中的 Cluster PAM 算法对大约 6000 行的数据集进行聚类。 我希望 PAM 算法忽略名为“ID”的列(不在集群中使用它),但我不想删除该列。我想稍后使用该列将我的聚类数据与原始数据集结合起来。 基本上我想要的是在原始数据集中添加一个集群列。 我想使用 PAM 作为数据压缩/变量减少方法。我有 220 个变量,我想对一些变量进行聚类并降低我的数据集的维数,这样我就可以应用分类算法(很可能是一棵树)来对我要解决的问题进行分类。 如果有人知道解决此问题的方法或更好的方法,请告诉我。 谢谢
【问题讨论】:
标签: r cluster-analysis