【发布时间】:2020-07-02 18:32:28
【问题描述】:
假设我有一个这样的 df:
id type length key1 key2 key3
0 1 A 144 [value1,value2] value3
1 1 B 20 value4 [value5]
2 4 A 54 [value6]
在 PySpark 中有没有办法让我从列表中获取 value5 和 value6,因为它们是唯一的元素?我想将此应用于所有单元格。输出将是:
id type length key1 key2 key3
0 1 A 144 [value1,value2] value3
1 1 B 20 value4 value5
2 4 A 54 value6
【问题讨论】:
-
能否请您试一试答案
标签: python list dataframe pyspark