【发布时间】:2018-11-04 23:31:10
【问题描述】:
我有 (Key,Value) 类型的 dstream。
mapped2.foreachRDD(rdd => {
rdd.foreachPartition(p => {
p.foreach(x => {
}
)})
})
我需要确保所有具有相同键的项目都在一个分区中由一个核心处理..所以实际上是按顺序处理的..
如何做到这一点?我可以使用低效的 GroupBykey 吗?
【问题讨论】:
标签: scala apache-spark spark-streaming