【问题标题】:How to decide a new data belongs to which cluster after clustering training data by using Mclust package in R使用R中的Mclust包对训练数据进行聚类后如何确定新数据属于哪个聚类
【发布时间】:2014-05-08 16:34:21
【问题描述】:

我正在使用 R 的 mclust 包来聚类时间进程的基因表达数据。 我成功地为少于 8000 行的数据 mod1<-mclust(data) 运行了 mclust 函数。对于每一行,我可以看到 mod1$zmod1$classification 的集群概率

但我需要确定,给定一个基因表达谱,假设 6 个时间点(实际上是一行)不在聚类数据中。如何确定它属于哪个先前获得的集群?

感谢回复...

【问题讨论】:

    标签: r


    【解决方案1】:

    当您想要基于由其他数据构建的模型对新观察结果进行预测时,您的第一个想法应该是 predict 函数。大多数建模包都重载了这个函数来做正确的事情。与mclust 包相同。这是使用iris 数据的示例

    mod1 <- Mclust(iris[,1:4])
    summary(mod1)
    plot(iris[,1:4], col=predict(mod1)$classification)
    pred<-predict(mod1, newdata=matrix(c(6.75,2.9,6,1.7),nrow=1))
    pred$classification  #predicted class
    

    阅读 ?predict.Mclust 帮助页面以获取完整文档

    【讨论】:

      猜你喜欢
      • 2014-01-30
      • 2015-12-28
      • 2019-05-29
      • 1970-01-01
      • 2018-11-04
      • 1970-01-01
      • 1970-01-01
      • 2013-10-02
      相关资源
      最近更新 更多