【发布时间】:2019-09-08 08:06:12
【问题描述】:
我需要对一些生物数据进行聚类或相似性分析,我正在寻找 SIMPROF 提供的输出。又名树状图或层次聚类。
但是,我每组有 3200 个观察值/行。 SIMPROF,请参见此处的示例,
library(clustsig)
usarrests<-USArrests[,c(1,2,4)]
rownames(usarrests)<-state.abb
# Run simprof on the data
res <- simprof(data= usarrests,
method.distance="braycurtis")
# Graph the result
pl.color <- simprof.plot(res)
似乎预计每组只观察一次(本例中为美国州)。 现在,我的生物数据(总共 140k 行)每组大约有 3200 个 obs。 我正在尝试将在提供的变量中具有相似表示的组聚集在一起。 就像在上面的示例中一样,AK 将由多个观察值表示。 对于函数/包/分析,我最好的选择是什么?
干杯, 莫
论文示例:
【问题讨论】:
标签: r cluster-analysis hierarchical-clustering multi-dimensional-scaling