【发布时间】:2021-02-21 15:29:06
【问题描述】:
我有一个这样的 Spark RDD:
[(1, '02-01-1950', 2.8), (2, '03-01-1950', 3.1), (3, '04-01-1950', 3.2)]
我想计算连续行之间的增加(按百分比)。例如,从第 1 行到第 2 行,value 增加了 110.7%((3.1/2.8)*100),以此类推。
关于如何在行之间进行计算有什么建议吗?
【问题讨论】:
标签: apache-spark pyspark rdd