【发布时间】:2021-08-14 16:58:10
【问题描述】:
我有这个 Spark 的 DataFrame:
+-------------+
|father|child |
+-------------+
|Aaron |Adam |
|Aaron |Berel |
|Aaron |Kasper|
|Levi |Saul |
|Levi |Tiger |
+-------------+
如何按父母分组并将所有数据放在一个带分隔符的字段中?
我想要的输出是:
+------------------------+
|union_all_name_by_father|
+------------------------+
|Aaron;Adam;Berel;Kasper |
|Levi;Saul;Tiger |
+------------------------+
【问题讨论】:
-
在Scala里,我什么都没试过,不知道该走哪条路
标签: scala dataframe apache-spark pyspark