【发布时间】:2017-05-07 13:28:05
【问题描述】:
我正在研究 Spark MLlib (Scala) 的二分 K-Means 算法。我使用的 Spark 版本是 2.0.2。
查看 Spark 示例代码 (examples/src/main/scala/org/apache/spark/examples/ml/BisectingKMeansExample.scala) 和平分 K-Means 的方法,我很难理解应该如何从 BisectingKMeansModel 类中检索分配的集群 ID/编号(不是集群中心)。
在 Spark/Scala 的 K-Means 实现中,可以使用 KMeansModel.summary.predictions 检索集群。
我想知道是否有一种有效的方法可以从二分 K-Means 模型中检索集群(不是示例中描述的集群中心)
【问题讨论】:
标签: scala apache-spark apache-spark-mllib