【问题标题】:How to sortBy in spark using a function?如何使用函数在火花中排序?
【发布时间】:2017-01-29 14:16:33
【问题描述】:

例如,我想使用元组中两个值的差异进行排序。我怎么能在 Spark 中做到这一点?

例如,我想要如下所示。

rdd.sortBy(_._2._1 - _._2._2)

【问题讨论】:

  • rdd.sortBy(r => r._2._1 - r._2._2),下划线不能使用多次,否则会被解释为两个不同的参数
  • 太棒了。谢谢。
  • @AlbertoBonsanto OK :)

标签: scala apache-spark rdd bigdata


【解决方案1】:

您不能多次使用下划线,否则它将被解释为两个不同的参数(并且预期的函数应该只有一个)。相反,命名参数并使用它两次:

rdd.sortBy(r => r._2._1 - r._2._2)

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2017-02-26
    • 2019-04-30
    • 1970-01-01
    • 2018-08-09
    相关资源
    最近更新 更多