【发布时间】:2021-08-21 16:13:21
【问题描述】:
我有一个元组列表 - 如何对每个元组的整数值执行 reduce?
val student=List((1,"akshay",60),(2,"salman",70),(3,"ranveer",50))
val student_rdd=sc.parallelize(student)
rdd1.reduce((a,b)=>(a._3+b._3)).collect
error: type mismatch;
found: Int
required: (Int, String, Int)
【问题讨论】:
-
您希望第一列和第二列发生什么?例如。 (1, "akshay", 60) 和 (2, "salman", 70) 应该变成 (X, Y, 130)。你希望 X 和 Y 在那里?
-
您是否只是在查找第 3 列中所有值的总和?
-
我想计算元组中最后一个值的总和、最小值、最大值、平均值。
标签: scala apache-spark rdd