【问题标题】:duplicate a column in pyspark data frame [duplicate]在pyspark数据框中复制一列[重复]
【发布时间】:2018-10-28 04:32:29
【问题描述】:

我在pyspark 中有一个数据框,如下面的示例。我想复制数据框中的一列并重命名为另一个列名。

Name    Age    Rate
Aira     23     90
Ben      32     98
Cat      27     95

期望的输出是:

Name    Age     Rate     Rate2
Aira    23      90       90
Ben     32      98       98
Cat     27      95       95

我该怎么做?

【问题讨论】:

标签: apache-spark pyspark


【解决方案1】:

只是

df.withColumn("Rate2", df["Rate"])

或(在 SQL 中)

SELECT *, Rate AS Rate2 FROM df

【讨论】:

    猜你喜欢
    • 2023-03-31
    • 1970-01-01
    • 1970-01-01
    • 2019-10-08
    • 1970-01-01
    • 1970-01-01
    • 2018-11-10
    • 2019-05-14
    • 2021-01-01
    相关资源
    最近更新 更多