【发布时间】:2017-06-17 23:30:20
【问题描述】:
我正在尝试用累加器逻辑替换 reduceByKey 以进行字数统计。
wc.txt
你好,你好吗
这是我目前得到的:
val words = sc.textFile("wc.txt").flatMap(_.split(" "))
val accum = sc.accumulator(0,"myacc")
for (i <- 1 to words.count.toInt)
foreach( x => accum+ =x)
.....
如何处理它。任何想法或想法表示赞赏。
【问题讨论】:
-
您的代码中的
foreach是什么?如果您想使用它,我看不出它怎么会调用RDD.foreach? -
谢谢,实际上预期的输出是 (Hello,1), (are,2), (how,1),(you,1)
-
我很确定这个例子不能编译。那么编译错误告诉你什么?
标签: scala apache-spark rdd