【发布时间】:2016-09-02 14:58:30
【问题描述】:
可能是我为此提出了非常基本的问题道歉,但我没有在互联网上找到它的答案。 groupBykey 是否维护值的顺序。在输入 RDD 中最先出现的值应该在输出 RDD 中最先出现。我试过这个,它正在为这个订单做主线,但我想从专家那里确认一下。我需要类似下面的东西
Input RDD [Int, Int]
1 20
2 10
1 8
1 25
Output RDD
1 20 8 25
2 10
【问题讨论】:
标签: scala apache-spark rdd