【发布时间】:2018-06-15 21:02:14
【问题描述】:
我正在尝试向我的 spark DF 添加一个新列。我了解可以使用以下代码:
df.withColumn("row",monotonically_increasing_id)
但我的用例是:
输入 DF:
col value
1
2
2
3
3
3
输出DF:
col_value identifier
1 1
2 1
2 2
3 1
3 2
3 3
关于使用 monotonically_increasing 或 rowWithUniqueIndex 获得此信息的任何建议。
【问题讨论】:
标签: scala apache-spark apache-spark-sql