【发布时间】:2016-11-14 10:16:04
【问题描述】:
假设我有这样的数据集:
Name | Subject | Y1 | Y2
A | math | 1998| 2000
B | | 1996| 1999
| science | 2004| 2005
我想拆分这个数据集的行,这样 Y2 列将被删除,例如:
Name | Subject | Y1
A | math | 1998
A | math | 1999
A | math | 2000
B | | 1996
B | | 1997
B | | 1998
B | | 1999
| science | 2004
| science | 2005
有人可以在这里提出一些建议吗?我希望我已经把我的问题说清楚了。提前致谢。
【问题讨论】:
-
@cheseaux 你为什么删除你的答案?这对我来说似乎是有效的。
标签: apache-spark spark-dataframe apache-spark-dataset