【发布时间】:2018-01-22 20:09:02
【问题描述】:
我将 kmeans 一分为二
bkm_test=BisectingKMeans().setK(5).setSeed(1)
rdf.cache()
assembled.cache()
model_test=bkm_test.fit(assembled)
当我不断收到错误时,我缓存了两个数据帧,但这并没有什么区别,我发现这个 question 与 kmeans 相似但很相似。 但我也在下面收到一个 WARN Executor 错误。这只是算法内部我无法修复的东西吗?
17/08/14 21:53:17 WARN BisectingKMeans: The input RDD 306 is not directly cached, which may hurt performance if its parent RDDs are also not cached.
17/08/14 21:53:17 WARN Executor: 1 block locks were not released by TID = 132:
[rdd_302_0]
【问题讨论】:
标签: pyspark spark-dataframe apache-spark-mllib apache-spark-ml