【发布时间】:2017-10-13 10:11:33
【问题描述】:
我有这种类型;
column1 column2 int
((a,b),1)
((a,c),1)
((k,a),1)
我需要两种类型的结果,首先是所有 column2 的 column1
(a,total)
其次column1参数不等于column2参数
(a,total)
对于这种类型,我如何使用 ReduceByKey ?
我的代码:
var data = sc.textFile("tttt.tsv")
var satir = data.map(line=> ((line.split("\t")(1).toString,line.split("\t")(2).toString),1))
---关于第二个场景
我的数据类型示例是
column1 column2 int
a b,1
a c,1
a a,1
a d,1
我需要 reduceByKey,因为在第二种情况下 column1 不等于 column1
例如,我的示例数据结果 = (a,b,1) + (a,c,1)+(a,d,1) = 3
【问题讨论】:
-
你能解释一下第二种情况吗
-
我添加了一些关于第二个场景的内容
标签: scala mapreduce case reduce bigdata