【发布时间】:2017-01-29 14:16:33
【问题描述】:
例如,我想使用元组中两个值的差异进行排序。我怎么能在 Spark 中做到这一点?
例如,我想要如下所示。
rdd.sortBy(_._2._1 - _._2._2)
【问题讨论】:
-
rdd.sortBy(r => r._2._1 - r._2._2),下划线不能使用多次,否则会被解释为两个不同的参数 -
太棒了。谢谢。
-
@AlbertoBonsanto OK :)
标签: scala apache-spark rdd bigdata