【发布时间】:2015-10-06 07:04:34
【问题描述】:
我有一些数据,我想根据它们的线性接近度将它们分成两组(即,几乎共线的点被组合在一起)。这是我的数据示例:
data <- data.frame(Y=c(seq(0,10,1), seq(0,4,0.5)), X= c(0:10,0:8))
plot(jitter(data$Y), jitter(data$X), pch=19)
我想要得到的结果是这样的:
显然,常规(hierarchical 或 K-means)聚类不起作用。此外,我尝试了spectral 聚类也没有提供好的结果。
非常感谢任何有关如何执行此操作的建议(使用clustering、regression 或其他方法)!谢谢
【问题讨论】:
-
你知道先验你在寻找多少个集群吗?
-
是的,我希望将它们分成两个集群。
标签: r filtering classification cluster-analysis linear-regression