【发布时间】:2015-05-04 17:25:42
【问题描述】:
我对 Hadoop 非常熟悉,但对 Apache Spark 完全陌生。目前我正在使用 Mahout 中实现的 LDA(潜在狄利克雷分配)算法来进行主题发现。但是,由于我需要使过程更快,我想使用 spark,但是在 Spark MLib 中没有实现 LDA(或 CVB)算法。这是否意味着我必须自己从头开始实现它?如果是这样,Spark 是否提供了一些工具来简化它?
【问题讨论】:
标签: hadoop apache-spark mapreduce apache-spark-mllib