【发布时间】:2016-03-24 13:46:02
【问题描述】:
我知道什么是 k-means,我也知道什么是 k-means++ 算法。我相信唯一的变化是找到初始 K 中心的方式。
在 ++ 版本中,我们最初选择一个中心,然后使用概率分布选择剩余的 k-1 个中心。
在 k-means 的 MLLib 算法中,initializationSteps 参数是什么?
【问题讨论】:
标签: apache-spark pyspark apache-spark-sql apache-spark-mllib